ElevenLabs Voice Design
Генерация уникальных голосов дикторов и персонажей по текстовому описанию на базе модели TTS v3.

Когда в стоковых каталогах дикторов нет подходящего тембра для сварливой ведьмы, древнего бога или пришельца с булькающим фальцетом, поиск заходит в тупик. Voice Design от ElevenLabs решает задачу через текстовое описание: вы задаете характер словами, а алгоритм собирает под него речь. Инструмент работает на базе модели Text to Speech v3 и позволяет озвучивать аниматики, игровые сцены и спецпроекты прямо из промпта.
Что умеет
- Синтез по описанию: вы задаете возраст, пол, высоту тона, подачу, скорость речи и нужные эмоциональные акценты в текстовом запросе.
- Широкий диапазон типажей: генератор воспроизводит как реалистичные голоса с характерными акцентами, так и гротескных сказочных персонажей.
- Предпрослушивание перед сохранением: сервис генерирует тестовую реплику по введенному фрагменту текста, позволяя оценить результат до добавления в библиотеку.
- Интеграция через API: разработчикам доступны отдельные эндпоинты для генерации превью и сохранения созданных голосов в проектный воркфлоу.
- Студийное качество: на расширенных тарифах доступен вывод звука в формате WAV PCM с частотой 44.1 кГц и коммерческие права на дорожки.
Цены и доступ
Начать работу можно бесплатно: базовый тариф дает 10 000 кредитов в месяц и 3 слота под созданные голоса. План Starter стоит 6 долларов ежемесячно (30 000 кредитов и 10 слотов). Тариф Creator обойдется в 22 доллара в месяц (первый месяц по акции — 11 долларов) за 121 000 кредитов и 30 слотов. Для объемного производства есть план Pro за 99 долларов в месяц с лимитом 600 000 кредитов, 160 слотами и поддержкой 32 языков.
Решение пригодится саунд-дизайнерам, режиссерам анимации и креаторам в рекламе, когда стандартная библиотека звучит слишком стерильно и проекту требуется редкий характерный тембр.
