OpenAI открыла доступ к режиму Ultrafast для модели GPT-5.6 Sol. Вычисления работают на базе нейронных процессоров Cerebras. Скорость генерации достигает 750 выходных токенов в секунду. Это в 14 раз быстрее стандартного вывода. Патч кода объемом 2000 токенов модель формирует за 2,7 секунды. Полный лимит ответа в 128 тысяч токенов генерируется менее чем за три минуты.
Сверхнизкая задержка меняет подход к проектированию систем. Объемные аналитические исследования теперь выполняются в формате интерактивной сессии. Режим ориентирован на near-production задачи. Среди них голосовые агенты реального времени, финансовый ресёрч, автоматизация техподдержки и быстрое реагирование на угрозы безопасности.
Сейчас доступ выдается в закрытом режиме. Инженеры OpenAI вручную отбирают корпоративные проекты. Главный критерий — наличие рабочих сценариев, где критична задержка ответа. Вычислительные мощности кластеров пока жестко ограничены.
Поделиться:
Трехнедельный интенсив «Продленкус» от Студии Лебедева: отказ от Figma в пользу работы со смыслами
Кембридж инициировал внешнее расследование после отставки профессора Джейсона Ардея из-за обвинений в плагиате