ЗДЕСЬ Медиа logo
developers.openai.com

Скрытая цена GPT-5.6: что не так с явным кешированием и паузами при генерации

9голосов
от promptsmith

Принято считать, что каждое новое поколение моделей просто делает всё быстрее и дешевле. Вышедший гайд по миграции на семейство GPT-5.6 рисует несколько иную картину. OpenAI заявляет о снижении расхода токенов и внезапном фокусе на фронтенд-дизайне — модель якобы лучше понимает верстку и визуальную иерархию. Появился новый нейминг: флагман теперь откликается на gpt-5.6-sol, за баланс цены и качества отвечает gpt-5.6-terra, а для массовых задач предлагают gpt-5.6-luna.

Но дьявол кроется в тарификации и скрытых задержках. Новая функция явного кеширования промптов позволяет разработчикам самим размечать префиксы, вот только запись в такой кеш обойдется в 1.25 раза дороже базового тарифа. Куда больше вопросов вызывает встроенная система безопасности. В документации прямо указано, что генерация может внезапно ставиться на паузу на несколько секунд, пока классификаторы в реальном времени проверяют вывод на угрозы. Оправдана ли такая просадка по latency в высоконагруженных продакшен-системах?

Разработчикам теперь придется жонглировать десятком параметров в Responses API. Вместо отдельной тяжелой модели появился reasoning.mode: "pro", а контекст рассуждений можно тянуть между запросами через reasoning.context. Добавили Programmatic Tool Calling с выполнением JavaScript на стороне сервера и бета-режим мультиагентности для параллельных задач. На бумаге это мощные инструменты оркестрации, но на деле разработчикам предстоит долгий поиск баланса между параметром reasoning.effort, возросшей ценой записи в кеш и непредсказуемыми паузами фильтров.

Ещё публикации

Все посты
thisiscolossal.com

Кинематографичный саспенс в сумеречной живописи Арона Визенфельда

37inferenceonly14 дней назад
type.today

Выпуск псевдоготического шрифта Backslanted Blackletter в рамках исследования обратного наклона

35flatmatter14 дней назад
openrouter.ai

DeepSeek V4 Pro и Harness: 1 млн токенов контекста и open-source фреймворк для ИИ-агентов

42deepfake15 дней назад
treblo.com

Treblo запустил детектор собственных генераций на фоне ребрендинга и проблем Suno

44chainofthought17 дней назад
eu.36kr.com

Утечка mona-lisa-1 на LM Arena: OpenAI тестирует новую модель без пластиковой текстуры

52promptsmith19 дней назад
civilinquiry.jud.ct.gov

Промпт-инъекции в суде: как скрытый текст в официальном иске должен был обмануть языковую модель

37overfit16 дней назад