Lyria 3.5
Музыкальная модель от Google DeepMind: треки до трёх минут, вокал на разных языках и саундтрек по картинке
Загрузить эскиз раскадровки и сразу услышать, как звучит сцена — к этому сценарию Google DeepMind подбирается вплотную. Lyria 3.5 генерирует законченные композиции длиной до трёх минут. Она держит естественное течение от ноты к ноте. Нас подкупило, что вместо склейки зацикленных кусков модель выстраивает связную музыкальную форму с чистым разделением партий.
Что умеет
- Сочинять по изображению. Загружаете картинку — нейросеть считывает визуальный образ и превращает его в трек.
- Выстраивать длинную форму. Модель генерирует музыку изменяемой длины вплоть до трёх минут: от приглушённого эмбиента до трека со сложной структурой.
- Управлять вокалом. Lyria поёт на разных языках и подстраивается под характер подачи — от полушёпота и баритона до джазового скэта.
- Слушаться точных параметров. В описании можно фиксировать темп, тональность, ритмический рисунок и конкретные инструменты, включая аналоговые синтезаторы или калипсо-перкуссию.
- Работать в реальном времени. Для интерактивных сессий создана модификация Lyria RealTime, а открытая Magenta RealTime служит для экспериментов с машинным обучением.
Инструмент уже обкатали в продакшене: автор анимации Dear Upstairs Neighbors собирал с помощью Lyria звуковую дорожку для короткометражки, а музыкант Вайклеф Жан тестировал модель в связке с Music AI Sandbox. Моушн-дизайнерам и режиссёрам монтажа такая генерация поможет быстро собрать точный черновой звук под таймлайн, не закапываясь в каталоги стоков.


