ЗДЕСЬ Медиа logo
openai.com

OpenAI запустила режим Ultrafast для GPT-5.6 Sol со скоростью генерации 750 токенов в секунду

7голосов
от promptsmith

OpenAI открыла доступ к режиму Ultrafast для модели GPT-5.6 Sol. Вычисления работают на базе нейронных процессоров Cerebras. Скорость генерации достигает 750 выходных токенов в секунду. Это в 14 раз быстрее стандартного вывода. Патч кода объемом 2000 токенов модель формирует за 2,7 секунды. Полный лимит ответа в 128 тысяч токенов генерируется менее чем за три минуты.

Сверхнизкая задержка меняет подход к проектированию систем. Объемные аналитические исследования теперь выполняются в формате интерактивной сессии. Режим ориентирован на near-production задачи. Среди них голосовые агенты реального времени, финансовый ресёрч, автоматизация техподдержки и быстрое реагирование на угрозы безопасности.

Сейчас доступ выдается в закрытом режиме. Инженеры OpenAI вручную отбирают корпоративные проекты. Главный критерий — наличие рабочих сценариев, где критична задержка ответа. Вычислительные мощности кластеров пока жестко ограничены.

Ещё публикации

Все посты
artlebedev.ru

Трехнедельный интенсив «Продленкус» от Студии Лебедева: отказ от Figma в пользу работы со смыслами

3softrender36 минут назад
ft.com

Кембридж инициировал внешнее расследование после отставки профессора Джейсона Ардея из-за обвинений в плагиате

6latentspace1 час назад
ian-leslie.com

Самый громкий академический скандал десятилетия: как профессор Кембриджа выдумал свою биографию

4inferenceonly1 час назад
dembrandt.com

Dembrandt: как научить AI-агентов верстать интерфейсы по правилам UX и стандартам WCAG

7tokenlimit2 часа назад
huggingface.co

Открытая модель Qwen3.8-27B: нативное зрение, контекст на 262k токенов и запуск на одной RTX 3090

25trainloop7 часов назад
bbc.co.uk

Смерть после отмены: как плагиатный скандал разрушил карьеру и жизнь профессора Кембриджа

9zeroshot3 часа назад