Новость

Яндекс открыл исходный код модели, которая генерирует быстрые ответы в Поиске

Фото: источник

У модели, которая ежемесячно отвечает на вопросы 49 миллионов человек прямо под строкой поиска, обычно не принято выкладывать внутренности в открытый доступ — это редкая для рынка практика. Яндекс выложил Alice AI Search Pretrain на Hugging Face под лицензией Apache 2.0 — причём именно ту базовую, необученную под конкретную задачу версию, из которой потом дообучивают продуктовую модель.

Компания называет это первым в своём роде опенсорс-релизом: обычно наружу выкладывают уже готовую, дообученную модель, а не тот «сырой» чекпоинт, на основе которого продуктовая версия строится. Alice AI Search Pretrain — компактная модель с гибридной архитектурой, которая раньше встречалась в основном в научных статьях, а не в продакшене: она соединяет энкодер-декодер, где одна часть модели изучает и отбирает информацию, а другая формулирует лаконичный ответ, и MoE — систему, которая включает только ту часть нейросети, что разбирается в конкретной теме, вместо того чтобы прогонять запрос через всю сеть целиком. У модели 35 миллиардов параметров, но на обработку одного токена уходит около 600 миллионов — меньше 2% от общего объёма, и именно это делает её нетребовательной к вычислительным мощностям при высокой скорости ответа.

По качеству ответов на русском языке, как утверждает Яндекс со ссылкой на слепое тестирование, модель обходит компактные Qwen 3.5 на 2 и 4 миллиарда параметров и T5 Gemma 2 4B-4B Base, а по уровню сопоставима с куда более прожорливой Qwen 3.5 35B-A3B.

Дообученная версия этой модели с июля уже работает в Поиске Яндекса — это и есть тот самый слой быстрых ИИ-ответов, который появляется прямо под строкой поиска. Чтобы ответы были ёмкими и по делу, а не растекались мыслью, разработчики обучали модель на реальных пользовательских сигналах и примерах того, как люди на самом деле взаимодействуют с поиском. По данным компании, это самый массовый генеративный продукт Яндекса: если считать по числу людей, которые ежемесячно сталкиваются с ИИ в продуктах компании, быстрые ответы в поиске обгоняют всё остальное.

Опенсорс базовой версии — жест в сторону исследователей и разработчиков, которые смогут изучить архитектуру и адаптировать её под свои задачи, а заодно и способ застолбить конкурентное преимущество: если гибридная архитектура действительно даёт такое соотношение качества к вычислительным затратам, о ней теперь будут писать статьи и ссылаться на Яндекс как на первопроходца, а не просто на ещё одного пользователя чужой архитектуры трансформера.

Для рынка это скорее любопытный прецедент, чем разовый жест доброй воли. Крупные компании обычно выкладывают в опенсорс либо совсем небольшие модели без коммерческой ценности, либо уже устаревшие версии, которые давно заменены новыми. Здесь же речь о том самом чекпоинте, с которого начинается путь к продукту, обслуживающему десятки миллионов запросов каждый месяц, — редкий случай, когда можно посмотреть не на витрину, а на фундамент.

Ещё новости

Все новости →