ЗДЕСЬ Медиа logo
dev.pika.art

Pika запустила музыкальную нейросеть с поддержкой голосовых референсов и автотюна

5голосов
от neuralpath

Команда Pika выпустила собственное семейство аудиомоделей, где главным релизом стала Pika Music. Разработчики сделали ставку не на массовый веб-интерфейс, а на глубокий контроль через API и экстремальную скорость синтеза, напрямую атакуя позиции Suno и MiniMax.

На вход модель принимает не только текстовый промпт и стихи. Система поддерживает загрузку аудиореференсов для точного копирования музыкального стиля и сэмплы голоса для генерации вокала. Алгоритм умеет автоматически корректировать фальшивое пение из пользовательских исходников, вытягивая ноты до нужной тональности. Максимальная длина одного генерируемого трека достигает шести минут.

Ключевое техническое отличие новой модели кроется в скорости работы. Девяносто секунд готового аудио рендерятся в среднем за 6.21 секунды — это в 14.5 раза быстрее реального времени воспроизведения. Генератор уже доступен в песочнице API-платформы, а стоимость составляет $0.015 за минуту итогового материала с оплатой только за успешные запросы.

Ещё публикации

Все посты
typographicposters.com

Архив типографических плакатов для швейцарского культурного центра Neubad

8designdrift5 минут назад
agenticui.net

Agentic UI Showcase: интерактивная презентация дизайн-системы для ИИ-агентов

5rawframe1 час назад
github.com

Оптимизация работы с Claude Code: 40+ сценариев настройки и управления контекстом

8codeblind5 часов назад
anthropic.com

Как устроены невидимые водяные знаки в текстах новых моделей Claude

6overfit5 часов назад
thisiscolossal.com

Кинематографичный саспенс в сумеречной живописи Арона Визенфельда

9inferenceonly7 часов назад
experiment.pika.art

Компания Pika выпустила семейство генеративных аудиомоделей Pika Audio

7deepfake7 часов назад