GPT-Live
Голосовой режим для ChatGPT: говорит и слушает одновременно, решая сложные задачи в фоне

Голосовые ассистенты годами спотыкались о паузы: стоило замолчать посреди фразы, чтобы подобрать формулировку для концепта, как робот перебивал невпопад. GPT-Live переводит ChatGPT Voice на полнодуплексную архитектуру — модель слушает и говорит одновременно, подает короткие сигналы внимания вроде «угу» и спокойно ждет, пока собеседник собирается с мыслями.
Что умеет
- Непрерывный диалог. Система оценивает обстановку десятки раз за секунду: понимает, когда нужно перебить, промолчать по просьбе или отфильтровать уличный шум.
- Фоновые вычисления. Задачу на сложный поиск в сети или рассуждения GPT-Live незаметно поручает модели GPT-5.5, не замораживая сам разговор.
- Градация глубины мыслей. Для генерации ответов можно выбрать быстрый темп Instant либо подключить варианты Medium и High с усиленным анализом.
- Визуальные подсказки. Прямо во время голосовой беседы на экране появляются информационные карточки. При этом сохраняется поддержка анализа картинок, файлов, памяти и веб-поиска.
- Девять голосов и живой перевод. Линейку стандартных голосов перезаписали, а саму архитектуру научили синхронному переводу на лету.
- Цифровые водяные знаки SynthID. Весь сгенерированный звук получает маркировку происхождения, которую можно проверить через публичный инструмент или API.
Цены и доступ
Голосовое обновление доступно на сайте сервиса, а также в приложениях для iOS и Android. Облегченная GPT-Live-1 mini открыта на бесплатном тарифе, тогда как флагманскую GPT-Live-1 по умолчанию получают подписчики планов Go, Plus и Pro. Позже появится интеграция через API. В первой версии нет работы с видео и демонстрации экрана, однако прежние голосовые режимы остаются в доступе.
Решение пригодится арт-директорам и продюсерам, привыкшим проговаривать идеи вслух между созвонами: модель держит плотный темп брейншторма, принимает входящие файлы и ищет данные прямо в ходе живой речи.

