Anthropic выпустила Claude Sonnet 5.5 с флагманской мощью по прежней цене

Пятьсот тысяч токенов на один финансовый отчет улетали в трубу буквально за пару минут. В инвестиционной компании Balyasny проверили новую Claude Sonnet 5.5 на тех же самых вычислениях: аппетит модели моментально сократился до 121 тысячи токенов на ответ, а на платформе Base44 рабочие прототипы приложений стали собираться всего за 3,6 итерации вместо прежних 7,7 у громоздкой Opus 5. Anthropic выкатила вторую модель в семействе 5.5, аккуратно сместив фокус с бесконечной гонки параметров на чисто утилитарную выгоду для продакшена.
Новинка пришла на смену Sonnet 5 и забрала себе роль главного рабочего инструмента на каждый день — для кодинга, генерации документов, верстки таблиц, сборки презентаций и отлова ошибок. Логика простая: модель отдает ответы более чем на 30% быстрее предшественницы и съедает до 30% меньше токенов при решении сопоставимой задачи. При этом ценник за вызовы остался на уровне Sonnet 5. Anthropic сохраняет модель Opus 5.5 для предельно тяжелых сценариев с глубокими умозаключениями, но в повседневных делах разница между ними почти стерлась.

Цены и затраты на миллион токенов
Экономика интеграции выглядит особенно показательно на фоне старшего флагмана, за который приходится отдавать ровно вдвое больше:
| Тип операции с токенами | Claude Sonnet 5.5 | Claude Opus 5.5 |
|---|---|---|
| Чтение из кэша (Cache reads) | $0,20 | $0,20 |
| Запись в кэш (Cache writes) | $2,50 | $5,00 |
| Входные токены (Input) | $2,00 | $4,00 |
| Выходные токены (Output) | $10,00 | $20,00 |

В тестах Sonnet 5.5 наступает старшим моделям на пятки, а кое-где уверенно забирает лидерство за счет оптимизации шагов. Модель эффективнее группирует вызовы внешних инструментов и не ходит по кругу там, где можно выдать готовый результат за один проход.
Результаты в профильных бенчмарках
- Terminal-Bench 4.0 (агентное программирование): 70,6% против 10,3% у Sonnet 5 и 66,4% у флагманской Opus 5.5.
- FrontierCode 1.1: 46,2% на профиле Max и 52,1% в режиме Xhigh.
- CursorBench 4.0: 55,5% — модель идет вплотную за показателями Opus.
- GDPval-AA v2.1 (оценка рутинных офисных задач по 44 профессиям): 1844 балла против 1846 у Opus 5.5 и 1449 у Sonnet 5.
- AA-Briefcase v1.1: 1811 баллов.
- OSWorld 2.1 (управление операционной системой и интерфейсом ПК): 80,1% (у Opus 5.5 — 81,8%).
- Humanity’s Last Exam (с подключением инструментов): 64,5%.
- Chartography (визуальный разбор графиков вслепую, без инструментов): 61,6%.
Нас подкупило, что нейросеть доказала способность ориентироваться в графике на практике: модель самостоятельно прошла культовую игру Pokémon Red, опираясь исключительно на визуальный анализ входящих скриншотов экрана. В бенчмарках на режимах Low и Medium effort новинка обходит пиковые результаты оригинальной Sonnet 5, обходясь примерно десятой долей от прежнего бюджета.

Разработчики предусмотрели гибкие уровни усиления мыслительного процесса, включая специальный параметр between_tools, позволяющий отключать этап предварительного размышления в API. При миграции систем без активного режима reasoning этот параметр нужно выставить вручную. Безопасность подтянули до стандартов Opus: внедрены киберфильтры повышенной строгости, которые при возникновении критических рисков автоматически откатывают запрос на проверенную Sonnet 5. Внутренний ход рассуждений защищен технологией preserved thinking и классификаторами против дистилляции, блокирующими попытки выкачать логику через поддельные профили. При работе через облака AWS, Google Cloud и Microsoft Azure действует строгая политика нулевого хранения пользовательских данных.
Инфраструктурный запуск не заставил себя ждать. 28 сентября 2026 года команда Amazon Web Services в лице Дани Митчелл, Аамны Наджми, Альфредо Кастильо и Софиана Хамити объявила о добавлении модели в каталог сервиса Amazon Bedrock. В преддверии осенней конференции re:Invent 2026 облачный провайдер делает ставку на быстрое развертывание автономных ИИ-агентов без головной боли с собственной серверной базой.
Одновременно Sonnet 5.5 появилась в GitHub Copilot для подписчиков линеек Pro, Pro+, Max, а также корпоративных планов Business и Enterprise с оплатой по факту фактического использования. Администраторы команд могут регулировать доступ через панель политик, хотя по умолчанию модель уже включена в список доступных решений. Постепенное развертывание охватывает целый стек инструментов разработки:
- Visual Studio Code и Visual Studio;
- среды разработки JetBrains IDEs, Xcode и Eclipse;
- консольный интерфейс Copilot CLI и автономный GitHub Copilot coding agent;
- веб-интерфейс github.com и отдельное веб-приложение Copilot;
- официальные мобильные клиенты GitHub Mobile под iOS и Android.

Инженеры уже отмечают, что переход не требует переписывания рабочих пайплайнов. Как сформулировал ведущий инженер Slack Кёртис Аллен: «Мы не меняли ни единого промпта, но Claude Sonnet 5.5 показала себя лучше Sonnet 5 практически во всех наших офлайн-тестах для Slackbot, уложившись в меньшее число шагов и потратив примерно на 14% меньше выходных токенов».
Для креативных команд, дизайнеров интерфейсов и моушн-директоров этот релиз закрывает вечную дилемму между скоростью и точностью. Больше не нужно выбирать между дешевой, но слегка невнимательной моделью и неповоротливым гигантом, чей ответ приходится ждать до остывания кофе: генерация интерактивных макетов, верстка документации и отладка скриптов автоматизации переходят в режим мгновенного отклика. В ближайшие недели Anthropic обещает показать еще более компактную Haiku 5.5, но рабочую лошадку для продакшена студии получили прямо сегодня.



