Новость

ElevenLabs встроила генерацию голоса, музыки и видео прямо в чат-ассистентов

Фото: ElevenLabs

Раньше, чтобы получить готовый ролик с озвучкой, дизайнер открывал одну вкладку для сценария, вторую — для озвучки, третью — для монтажа. ElevenLabs решила стереть эту границу и научила собственный MCP-коннектор делать почти всё сразу, прямо внутри чат-ассистента.

До сих пор коннектор умел только один трюк — управлять голосовыми агентами компании из Claude, ChatGPT или Cursor. Теперь через него, не выходя из переписки, можно попросить:

  • сгенерировать озвучку голосом из библиотеки;
  • расшифровать запись через Scribe — с метками говорящих и таймкодами на 99 языках;
  • сделать дубляж, который сохраняет исходный голос, тон и манеру говорящего;
  • собрать музыкальный трек или звуковые эффекты под конкретную сцену;
  • сгенерировать изображение и видео с липсинком.

За коннектором стоит больше пятидесяти моделей ElevenLabs, а установка занимает пару кликов: он уже есть в каталоге интеграций Claude, ChatGPT и Cursor, а также работает в Grokbot, Hermes и других ассистентах — вход через OAuth, без ключей API и ручной настройки.

Логика простая: бриф можно описать один раз, а дальше собирать из него сценарий, голос, музыкальную подложку и видеоряд в одном чате, не сохраняя промежуточные файлы вручную. Каждый результат сразу попадает в рабочее пространство ElevenCreative, где его можно доработать в Studio — подрезать таймлайн, поправить дикцию, добавить музыку и экспортировать готовую версию.

Это тот же коннектор, которым уже пользуются команды, подключавшие ElevenLabs для управления голосовыми агентами, — на них обновление распространяется само, без переустановки. Администраторы рабочего пространства решают, какие инструменты доступны через подключение, а регион хранения данных выбирается ещё на этапе подключения, так что контроль за тем, куда уходит контент, остаётся у тех, кто отвечает за аккаунт.

Каждый узел, доступный в визуальном конструкторе Flows, доступен и через MCP — то есть диапазон того, что можно собрать прямо из чата, совпадает с тем, что раньше требовало отдельного конструктора. Из одного брифа теперь получается сценарий, озвучка, музыкальная подложка, звуковой дизайн и видеоряд — раньше это означало открыть пять разных вкладок и вручную сводить результат воедино, а теперь всё собирается в одном разговоре с ассистентом.

Раньше подключить голос, музыку и видео к рабочему чату означало собирать связку из нескольких сервисов и следить, чтобы она не рассинхронизировалась. ElevenLabs выбрала более прямой путь — принести весь стек внутрь диалога, который дизайнер и так держит открытым весь день.

Фото: ElevenLabs

Ещё новости

Все новости →