Перейти к содержанию
четверг, 30 июля 2026 г.

ИИ Вестник

Главные новости о развитии искусственного интеллекта в России

Google обновила музыкальный ИИ Lyria 3.5: акцент на эмоциональную глубину и тембральное богатство

Источник: 3DNews:
Photorealistic studio scene of Lyria 3.5 AI generating emotional waveforms.
Generated by Sourceful Riverflow (RouterAI)

Корпорация Google представила третью крупную версию своей генеративной музыкальной модели Lyria. Разработчики заявляют, что алгоритм научился создавать более выразительные и насыщенные по тембру композиции, приближаясь к уровню живого исполнения. Обновление стало ответом на растущую конкуренцию в сегменте ИИ-композиторов.

Компания Google выпустила обновление своей системы искусственного интеллекта для создания музыки — Lyria 3.5. Новая версия модели, разработанная подразделением DeepMind, ориентирована на повышение эмоциональной выразительности генерируемых треков. Разработчики утверждают, что алгоритм теперь способен передавать тонкие нюансы настроения и динамику музыкального повествования, которые ранее были доступны только человеку. Релиз состоялся в конце недели и уже доступен для тестирования через облачную платформу Google Cloud AI. Это третье крупное обновление с момента анонса Lyria в 2023 году: предыдущие версии уже демонстрировали впечатляющие результаты в генерации инструментальных партий, но именно Lyria 3.5 впервые делает акцент на эмоциональной глубине и тембральной насыщенности, что приближает ИИ-композиции к уровню живых оркестровых записей.

Ключевым улучшением Lyria 3.5 стала доработка механизма управления тембральными характеристиками и гармонической структурой. Модель научилась точнее имитировать акустические инструменты и вокал, сохраняя при этом естественность звучания. По данным Google, алгоритм был обучен на расширенном наборе данных, включающем записи концертов, студийные сессии и редкие этнические инструменты. В результате система может создавать композиции длительностью до десяти минут без потери качества, что вдвое превышает возможности предыдущей версии. Кроме того, улучшена обработка пауз и переходов между частями произведения. С технической точки зрения Lyria 3.5 использует гибридную архитектуру, сочетающую диффузионные модели и трансформеры внимания. Это позволяет разделять задачи генерации мелодии, аккомпанемента и аранжировки, а затем объединять их в единое полотно. Пользователи могут задавать параметры стиля, темпа и тональности, а также влиять на эмоциональную окраску через текстовые промпты. Важной особенностью стала поддержка многодорожечного экспорта: сгенерированный трек можно разложить на отдельные инструментальные партии. Это открывает возможности для последующей обработки в профессиональных DAW-средах, что особенно ценно для саунд-дизайнеров и композиторов, работающих в кино и игровой индустрии.

На рынке генеративных музыкальных инструментов Lyria 3.5 конкурирует с такими продуктами, как Suno V4, Udio и Meta AudioCraft. Если Suno делает упор на текстопорождающие способности и быструю генерацию коротких треков за считанные секунды, а Udio — на простоту интерфейса и доступность для массового пользователя, то Google делает ставку на академическое качество звука и интеграцию с экосистемой облачных сервисов. Важно, что Lyria изначально разрабатывалась как часть исследовательского проекта, поэтому она менее доступна массовому пользователю по сравнению с коммерческими аналогами. Тем не менее, предыдущие версии уже использовались инди-музыкантами и саунд-дизайнерами для создания фоновой музыки и звуковых эффектов. В прямом сравнении Lyria 3.5 выигрывает в точности передачи эмоций и богатстве тембров, но проигрывает в скорости генерации: Suno V4 способна создавать короткие треки за несколько секунд, тогда как Google-модели требуют до минуты на обработку. Однако качество звучания Lyria 3.5 приближается к записям реальных оркестров, что делает её предпочтительной для задач, где важен высокий реализм. Аналитики отмечают, что Google намеренно жертвует производительностью ради качества, сохраняя позиции в академическом и премиальном сегментах.

Для российского рынка появление Lyria 3.5 имеет двойственное значение. С одной стороны, модель открывает доступ к передовым технологиям звукового дизайна для локальных продюсеров и композиторов, работающих в жанрах электронной и экспериментальной музыки. С другой стороны, из-за ограничений на использование зарубежных облачных сервисов полноценная работа с моделью может быть затруднена. Некоторые российские разработчики уже создают аналогичные решения на основе открытых весов предыдущих версий модели, но их качество пока уступает официальной версии. В долгосрочной перспективе появление Lyria 3.5 может стимулировать развитие отечественных ИИ-композиторов, ориентированных на русскую музыкальную традицию, ведь возможность тонкой настройки тембра и эмоциональной окраски особенно востребована в фольклорных и академических жанрах. Кроме того, интеграция Lyria с Google Cloud может быть полезна для компаний, которые продолжают работать с зарубежными облачными платформами через партнёрские соглашения.

Дополнительный контекст для российского музыкального сообщества составляет исследовательский потенциал модели. Открытые веса предыдущих версий Lyria, распространяемые Google DeepMind, уже используются в ряде российских вузов и лабораторий для экспериментов с генерацией музыки в русском фольклорном стиле. Возможность точной настройки тембра и эмоциональной окраски позволяет адаптировать модель под звучание народных инструментов, таких как гусли, балалайка или жалейка, что особенно важно для аутентичного воспроизведения. Однако из-за отсутствия прямого доступа к облачным вычислительным мощностям Google внутри России многие разработчики вынуждены использовать альтернативные инфраструктуры, что снижает скорость работы и увеличивает затраты. Тем не менее, сам факт выхода Lyria 3.5 привлекает внимание к направлению ИИ-композиции и может ускорить создание отечественных аналогов, адаптированных под локальные культурные коды.

Перспективы развития Lyria 3.5 связаны с интеграцией в другие продукты Google, такие как YouTube Music и Google Slides. Возможно появление функции автоматического озвучивания видео или презентаций с учётом настроения контента. Открытым остаётся вопрос авторского права: модель обучалась на тысячах защищённых произведений, что может вызвать претензии со стороны лейблов. Google пока не комментирует правовую политику, но ожидается, что в будущем будут внедрены механизмы проверки на плагиат, аналогичные тем, что используются в других генеративных моделях компании. В целом Lyria 3.5 знаменует очередной этап в эволюции ИИ-творчества, делая синтез музыки всё более неотличимым от работы человека. При этом остаются открытые вопросы о том, как модель справляется с длительными композициями (до десяти минут) без потери музыкальной логики, и насколько глубоко пользователь может влиять на структуру произведения через текстовые промпты. Тестирование на облачной платформе Google Cloud AI уже началось, и первые отзывы от профессиональных музыкантов ожидаются в ближайшие недели.

Читайте также