Google представил Gemini 3: 1501 Elo в LMArena, ответы без лести и агентская платформа Antigravity

Google выкатил Gemini 3, и это самый мощный апдейт их базовых моделей за долгое время. Модель научилась не просто парсить текст или картинки, а буквально считывать негласный контекст задачи. Разработчики вырезали из ответов программную вежливость и клише. Теперь нейросеть выдает прямые факты по делу, выступая скорее строгим аналитиком, чем услужливым собеседником.
Цифры в бенчмарках полностью оправдывают этот подход. Версия Gemini 3 Pro пробила потолок в слепых тестах LMArena, набрав рекордные 1501 Elo. Она демонстрирует аспирантский уровень рассуждений: 91.9% в метрике GPQA Diamond и 37.5% в сложнейшем Humanity’s Last Exam вообще без доступа к интернету! Мультимодальный движок тоже перебрали, так что ИИ теперь уверенно разбирает видео и комплексные визуальные данные с результатом 87.6% в Video-MMMU.
Раскатка обновления идет сразу на всю экосистему компании. Доступ уже открыт в поиске и нативных приложениях, а инженеры могут дергать API через AI Studio и Vertex AI. Для самых зубодробительных задач анонсировали режим Deep Think, который берет паузу на пошаговое рассуждение перед ответом. Параллельно Google запустил Google Antigravity — отдельную среду для сборки автономных ИИ-агентов на базе новой архитектуры.
Поделиться:
Ещё из архива
Все публикации
Интервью с Владимиром Аюевым: графический язык бигтеха, студия SASHA и дизайн-образование
1 месяц назад
Jockey от TwelveLabs: ИИ-агент для семантического поиска по видеоархивам и извлечения метаданных
1 месяц назад
Архитектура винной этикетки: баланс наборного шрифта и каллиграфии в кейсе Winecraft
1 месяц назад
Оптимизация контекста в Claude Code: как работает кэширование промптов и за что мы платим
1 месяц назад
Архитектура памяти для LLM-агентов: от базового SQLite до Graph RAG
1 месяц назад