Anthropic выпустили Claude Opus 5, и это серьезный апгрейд для сложных рабочих процессов. Модель выдает результаты на уровне старшей версии Fable 5, но обходится в два раза дешевле. На бенчмарках вроде Frontier-Bench и CursorBench 3.2 она отстает от флагмана всего на полпроцента при максимальных настройках. Это делает Opus 5 оптимальным дефолтным инструментом для разработчиков, которым нужен умный ассистент без переплат за каждый токен.
Главная фишка новой версии — самостоятельность и дотошность. Opus 5 не просто пишет код, а ведет себя как полноценный автономный агент. В одном из тестов модели поручили воссоздать машинную деталь в виде 3D-модели для FreeCAD, намеренно отключив прямое распознавание графики. Нейросеть сама написала пайплайн компьютерного зрения, вытащила геометрию из сырых пикселей и собрала проект! Там, где прошлые поколения правили только симптомы багов, Opus 5 находит корневую причину и пишет собственные тестовые среды для проверки исправлений.
Прирост качества заметен далеко за пределами чистого программирования. На Zapier AutomationBench модель решает комплексные бизнес-задачи в полтора раза успешнее конкурентов за ту же цену. Разработчики интерфейсов отмечают, что Opus 5 научился самостоятельно проверять верстку. Сетка открывает сгенерированные страницы в виртуальном браузере, находит перекрытые элементы на мобильных разрешениях и правит код.
Поделиться:
ODS: запуск локальной LLM, Open WebUI и RAG одной командой
AI-ответы в HTML вместо Markdown: зачем Anthropic предлагает менять стандарты разметки