В последнем обновлении прайсинга GPT-5.6 кроется прецедент, меняющий экономику разработки агентов. OpenAI поручила старшей модели Sol автономно переписать production-ядра собственных серверов. Нейросеть самостоятельно ставила эксперименты по генерации токенов, что снизило стоимость обслуживания инфраструктуры на 20% и ускорило инференс на 15%. Полученную вычислительную экономию компания напрямую конвертировала в агрессивный демпинг на младшие модели.
Базовая gpt-5.6-luna подешевела сразу на 80%. Теперь миллион токенов на вход стоит $0.20, а на выход — $1.20. По данным разработчиков, в специализированных бенчмарках Luna обходит Fable 5, снижая итоговую стоимость выполнения профессиональной задачи на 99%. Сбалансированная версия Terra скинула 20% цены — до $2 на вход и $12 на выход.
Флагманская Sol сохранила базовую цену, но получила режим Fast mode. За двойную плату API ускоряет выдачу в 2.5 раза без потери качества — опция работает обратно совместимо для запросов со старым тегом priority. Такой экстремальный разброс цен между Luna и Sol окончательно закрепляет паттерн многоуровневого роутинга в приложениях: тяжелая модель формирует архитектуру решения и разрешает логические конфликты, а сверхдешевая Luna за копейки пишет код, прогоняет тесты и выполняет рутинную обработку массивов данных.
Поделиться:
Инди-студия Torchlight Games ищет 2D-художника для создания Steam-обложки соулслайка False Hero
Клонирование голоса в Suno: как работает синтез авторского вокала на базе сырых записей