Команда Pika выпустила собственное семейство аудиомоделей, где главным релизом стала Pika Music. Разработчики сделали ставку не на массовый веб-интерфейс, а на глубокий контроль через API и экстремальную скорость синтеза, напрямую атакуя позиции Suno и MiniMax.
На вход модель принимает не только текстовый промпт и стихи. Система поддерживает загрузку аудиореференсов для точного копирования музыкального стиля и сэмплы голоса для генерации вокала. Алгоритм умеет автоматически корректировать фальшивое пение из пользовательских исходников, вытягивая ноты до нужной тональности. Максимальная длина одного генерируемого трека достигает шести минут.
Ключевое техническое отличие новой модели кроется в скорости работы. Девяносто секунд готового аудио рендерятся в среднем за 6.21 секунды — это в 14.5 раза быстрее реального времени воспроизведения. Генератор уже доступен в песочнице API-платформы, а стоимость составляет $0.015 за минуту итогового материала с оплатой только за успешные запросы.
Поделиться:
Архив типографических плакатов для швейцарского культурного центра Neubad
Agentic UI Showcase: интерактивная презентация дизайн-системы для ИИ-агентов