ElevenLabs встроила генерацию голоса, музыки и видео прямо в чат-ассистентов

Раньше, чтобы получить готовый ролик с озвучкой, дизайнер открывал одну вкладку для сценария, вторую — для озвучки, третью — для монтажа. ElevenLabs решила стереть эту границу и научила собственный MCP-коннектор делать почти всё сразу, прямо внутри чат-ассистента.
До сих пор коннектор умел только один трюк — управлять голосовыми агентами компании из Claude, ChatGPT или Cursor. Теперь через него, не выходя из переписки, можно попросить:
- сгенерировать озвучку голосом из библиотеки;
- расшифровать запись через Scribe — с метками говорящих и таймкодами на 99 языках;
- сделать дубляж, который сохраняет исходный голос, тон и манеру говорящего;
- собрать музыкальный трек или звуковые эффекты под конкретную сцену;
- сгенерировать изображение и видео с липсинком.
За коннектором стоит больше пятидесяти моделей ElevenLabs, а установка занимает пару кликов: он уже есть в каталоге интеграций Claude, ChatGPT и Cursor, а также работает в Grokbot, Hermes и других ассистентах — вход через OAuth, без ключей API и ручной настройки.
Логика простая: бриф можно описать один раз, а дальше собирать из него сценарий, голос, музыкальную подложку и видеоряд в одном чате, не сохраняя промежуточные файлы вручную. Каждый результат сразу попадает в рабочее пространство ElevenCreative, где его можно доработать в Studio — подрезать таймлайн, поправить дикцию, добавить музыку и экспортировать готовую версию.
Это тот же коннектор, которым уже пользуются команды, подключавшие ElevenLabs для управления голосовыми агентами, — на них обновление распространяется само, без переустановки. Администраторы рабочего пространства решают, какие инструменты доступны через подключение, а регион хранения данных выбирается ещё на этапе подключения, так что контроль за тем, куда уходит контент, остаётся у тех, кто отвечает за аккаунт.
Каждый узел, доступный в визуальном конструкторе Flows, доступен и через MCP — то есть диапазон того, что можно собрать прямо из чата, совпадает с тем, что раньше требовало отдельного конструктора. Из одного брифа теперь получается сценарий, озвучка, музыкальная подложка, звуковой дизайн и видеоряд — раньше это означало открыть пять разных вкладок и вручную сводить результат воедино, а теперь всё собирается в одном разговоре с ассистентом.
Раньше подключить голос, музыку и видео к рабочему чату означало собирать связку из нескольких сервисов и следить, чтобы она не рассинхронизировалась. ElevenLabs выбрала более прямой путь — принести весь стек внутрь диалога, который дизайнер и так держит открытым весь день.



