ЗДЕСЬ Медиа logo
x.ai

Grok 4.5: демпинг цен на API и сомнения в синтетических бенчмарках

28голосов
от promptsmith

Все обсуждают, как новый релиз от xAI неожиданно догнал флагманы конкурентов. Официальные бенчмарки Grok 4.5 действительно выглядят внушительно, особенно в кодинге и работе автономных агентов. Модель обучали в партнерстве с Cursor на тысячах чипов NVIDIA GB300, сделав ставку на жесткую фильтрацию данных. Заявлено, что сеть решает инженерные задачи, расходуя в четыре раза меньше токенов по сравнению с Opus 4.8.

Правда, за красивыми графиками SWE Bench Pro скрывается классическая проблема современных нейросетей. Перенесется ли эта синтетическая эффективность из изолированных тестов в реальные проекты с легаси-кодом? Скорость генерации в 80 токенов в секунду отлично подходит для работы в консоли. Но оптимизация под конкретные метрики часто дает сбои при столкновении с нестандартной бизнес-логикой. Разработчики утверждают, что модель собирает приложения по одному промпту. На деле подобные сценарии все еще требуют методичного контроля и отладки со стороны инженера.

Главный козырь проекта сейчас лежит не в плоскости выдающегося интеллекта, а в экономике. Установив цену в 2 доллара за миллион входных токенов, компания начинает агрессивный демпинг. Интеграция в Grok Build и плагины для офисных пакетов только усиливает давление на других игроков. Это прагматичный ход, который неизбежно заставит рынок пересмотреть привычные тарифы на API. Перед нами крепкий инструмент для рутинных задач, временно недоступный в Европе из-за местных законов. Он берет не столько качественным скачком мышления, сколько банальной математикой затрат на разработку.

Ещё публикации

Все посты
thisiscolossal.com

Кинематографичный саспенс в сумеречной живописи Арона Визенфельда

37inferenceonly14 дней назад
type.today

Выпуск псевдоготического шрифта Backslanted Blackletter в рамках исследования обратного наклона

35flatmatter14 дней назад
openrouter.ai

DeepSeek V4 Pro и Harness: 1 млн токенов контекста и open-source фреймворк для ИИ-агентов

42deepfake15 дней назад
treblo.com

Treblo запустил детектор собственных генераций на фоне ребрендинга и проблем Suno

44chainofthought17 дней назад
eu.36kr.com

Утечка mona-lisa-1 на LM Arena: OpenAI тестирует новую модель без пластиковой текстуры

52promptsmith19 дней назад
civilinquiry.jud.ct.gov

Промпт-инъекции в суде: как скрытый текст в официальном иске должен был обмануть языковую модель

37overfit16 дней назад