Новость

ACE Studio 2.0 научилась собирать хоры и писать саундтреки под монтажные склейки видео

Иллюстрация: редакция ЗДЕСЬ

Знакомая картина в продакшене: черновой ролик собран, таймлайн горит, а на месте будущей песни в референсе лежит безликий синтетический голос из старых библиотек или чужой трек с водяными знаками, который клиент уже успел полюбить. Разработчики платформы ACE Studio выкатили масштабное обновление 2.0, превратив свой вокальный движок в полноценную облачную рабочую среду, где генеративные алгоритмы состыкованы с привычным студийным контролем по MIDI.

Вокальный конструктор и хоровые пачки

В центре платформы находится обновленный синтезатор вокала, опирающийся на библиотеку из более чем 140 голосов на 8 языках. Это не статичные сэмплы, а гибкие модели, реагирующие на вводимый текст и партитуру. Продюсер или моушн-дизайнер может нарисовать партию нотами, вписать текст и вручную откалибровать поведение голоса: подтянуть микровысоту тона, настроить фазировку вибрато, скорректировать отдельные фонемы и добавить нужные эмоциональные оттенки — от спокойной повествовательной подачи до экспрессивной драмы.

Для масштабных композиций в систему добавили режим Choir Mode. Работать с ним можно методом drag-and-drop: вы просто перетаскиваете нужные типы партий на рабочую панель, собирая хоровой ансамбль под конкретную задачу. Доступны четыре стилистических направления:

  • поп-музыка с плотными современными гармониями;
  • эмоциональный госпел с характерным напором;
  • детские хоровые коллективы;
  • академическая оперная фактура.

Если вокальную мелодию проще напеть в микрофон телефона, чем прописывать вручную, пригодятся встроенные алгоритмы Audio to MIDI и Vocal to MIDI. Они разбирают аудиофайл, распознают высоту нот и превращают черновую дорожку в редактируемую MIDI-партитуру с текстом, которую затем можно мгновенно переназначить на любой из доступных виртуальных тембров.

Смычковые из Будапешта и оркестровые слои

Вторым заметным блоком обновления стала секция виртуальных инструментов AI Instruments. Разработчики представили первую в своем роде систему виртуальных струнных AI String Sections, созданную на основе реальных сессионных записей коллектива Budapest Art Orchestra. Движок имитирует плотное кинематографическое звучание оркестровой группы голливудского толка: струнные здесь не звучат как зацикленный синтезатор, а отрабатывают реалистичные штрихи смычка и естественное голосоведение в зависимости от поступающих MIDI-событий. Для создания насыщенных звуковых полотен предусмотрен Ensemble Mode, позволяющий собирать несколько нейросетевых инструментов на одной дорожке в единую полифоническую фактуру.

От стемов до монтажного стола

Помимо вокала и инструментов, ACE Studio 2.0 упаковала в единый интерфейс набор утилит для повседневного продакшена:

  • Generative Kits и режим Inspire Me — генерация музыкальных заготовок, сэмплов и фактур по текстовому описанию;
  • Stem Splitter — алгоритм для чистого разделения готовых треков на изолированные инструментальные и вокальные дорожки;
  • Music Enhancer — блок постобработки, доводящий черновые идеи, наброски и разрозненные стемы до коммерческого звучания;
  • Video Composer (Sound for Video) — встроенный ИИ-агент для работы с визуальным рядом. Инструмент анализирует видеофайл, считывает монтажные склейки, динамику сцен и общее настроение кадров, после чего автоматически генерирует музыку и расставляет синхронизированные звуковые эффекты (SFX) строго по таймлайну.

Интеграция в DAW и юридическая чистота

Чтобы платформой можно было пользоваться в реальном студийном пайплайне, компания выпустила плагин ACE Bridge 2.1. Он поддерживает форматы VST3, AU и AAX, а также работает с протоколом синхронизации темпа и воспроизведения по ARA (Tempo Sync by ARA). Это позволяет открывать облачное рабочее пространство как вспомогательное окно прямо внутри вашей цифровой звуковой станции (DAW), не тратя время на бесконечный экспорт и импорт файлов туда и обратно. При этом важно помнить о техническом ограничении: поскольку все вычисления, генерация и рендеринг происходят на удаленных серверах, для работы со средой необходимо постоянное и стабильное интернет-подключение.

Пожалуй, самый прагматичный аспект обновления — лицензионная архитектура. Пользовательские исходники, текстовые наброски, вокальные треки и персональные модели шифруются, не передаются третьим лицам и принципиально не используются для тренировки чужих систем. Обучение базовых моделей проходило в прямом партнерстве с профессиональными вокалистами и музыкантами, которые получают отчисления роялти в зависимости от частоты использования их тембров в сервисе. Для конечного автора это снимает главный коммерческий страх: созданный в программе контент имеет статус royalty-free, его разрешено монетизировать в рекламе, на стриминговых площадках, в видеоиграх и на YouTube без скрытых сборов и риска нарваться на страйк правообладателя.

По-нашему, релиз закрывает давний разрыв между демонстрационными генераторами треков из одной кнопки и профессиональным софтом для аранжировок. Мы бы попробовали скормить Video Composer черновую анимацию рекламного ролика — хотя бы ради того, чтобы увидеть, как машина справляется с расстановкой акцентов на быстрых склейках.

Вместо бесконечного поиска чужих сэмплов на стоках продакшен получает послушный оркестр и хор, готовые петь на восьми языках строго в сетку вашего таймлайна.

Ещё новости

Все новости →