Grok Voice Think Fast 2.0
Речевая модель с параллельным рассуждением и откликом за доли секунды

Обычные голосовые боты замирают, чтобы подумать, либо выпаливают заготовленные фразы без глубокой логики. Grok Voice Think Fast 2.0 рассуждает параллельно с речью: внутренняя обработка запроса идет прямо во время говорения, сокращая время до первого звука до 0,7 секунды.
Что умеет
- Мыслить во время диалога: система выполняет логические шаги параллельно синтезу звука. Затраты reasoning-токенов снизились до 0,4 от базового уровня прошлой версии, поэтому команды и внешние инструменты срабатывают еще до конца первого предложения.
- Вести естественную беседу: модель формулирует мысли короткими фразами, задает строго по одному вопросу за раз и избегает пустых вводных конструкций, удерживая в памяти многошаговые ветки сценария.
- Разбирать речь в шуме: алгоритм поддерживает 24 языка и показывает низкий процент ошибок транскрипции даже в условиях сильного уличного фона или телефонного сжатия звука.
- Работать без правок промптов: обновление архитектуры не ломает существующие инструкции — во время тестов на телефонных линиях Starlink модель нарастила продажи и процент решенных обращений в поддержку.
Цены и доступ
Использование речевого API тарифицируется по цене $0,08 за минуту аудио. Доступно бесплатное тестирование в веб-консоли. Автоматический перевод алиаса grok-voice-latest на вторую версию запланирован на 5 августа 2026 года.
По-нашему, модель пригодится командам, которые собирают голосовые интерфейсы для интерактивных инсталляций, физических стендов или диалоговых бренд-ассистентов: здесь пауза в лишнюю секунду обычно сразу выдает фальшь робота.


