ACE-Step 1.5
Быстрая открытая нейросеть для генерации и точного редактирования треков на собственном железе
Полноценный саундтрек для ролика или концепта теперь можно собрать локально, не отдавая подписки облачным сервисам. ACE-Step 1.5 — открытая базовая модель для сочинения музыки, которая совмещает языковую модель-планировщик и диффузионный трансформер. На видеокарте уровня RTX 3090 трек собирается быстрее десяти секунд, а на скромных конфигурациях система укладывается меньше чем в 4 ГБ видеопамяти.
Что умеет
- Генерировать длинные композиции: хронометраж настраивается от 10 секунд до 10 минут, доступен пакетный рендер до восьми треков сразу.
- Тонко управлять звуком: задает темп (BPM), тональность, музыкальный размер и передает нюансы более тысячи инструментов и стилей.
- Писать вокал и тексты: генерирует партии со словами более чем на 50 языках и автоматически размечает синхронные субтитры LRC.
- Редактировать готовое аудио: умеет перерисовывать фрагменты дорожки (repaint), создавать каверы, дописывать аккомпанемент к голосу (Vocal2BGM) и раскладывать трек на отдельные стемы.
- Встраиваться в стек: запускается через веб-интерфейс Gradio, Python-скрипты, REST API или плагин формата VST3 прямо внутри вашей DAW.
- Обучаться стилю: позволяет натренировать персональную LoRA всего по восьми композициям примерно за час.
Цены и доступ
Код и веса моделей полностью открыты на GitHub и Hugging Face. Исходники запускаются на Windows, macOS и Linux с графическими чипами Nvidia, AMD или Apple Silicon. Для тех, кто не хочет возиться с терминалом и зависимостями, авторы держат бесплатную онлайн-версию на acemusic.ai.
Инструмент пригодится моушн-дизайнерам, режиссерам монтажа и саунд-дизайнерам, которым нужен строгий контроль над таймингами и тональностью фоновой музыки без лицензионных ограничений.
