MiMo-V2.5-Pro
Открытая языковая модель на триллион параметров с контекстом в миллион токенов и автономным кодингом
Команда Xiaomi выкатила MiMo-V2.5-Pro — открытую модель на архитектуре Mixture-of-Experts с общим объемом 1,02 триллиона параметров (активны 42 миллиарда). Разработка нацелена на длинные агентские сценарии: она способна часами писать код без вмешательства человека, удерживая структуру сложного проекта в гигантском окне контекста на 1 миллион токенов.
Что умеет
- Держать фокус на длинной дистанции. Модель выдерживает цепочки свыше тысячи последовательных вызовов инструментов, разбирает скрытые ошибки и исправляет собственные регрессии кода без потери контекста.
- Создавать софт под ключ. По обычному промпту нейросеть за 11,5 часов автономной работы собрала десктопный видеоредактор на 8 192 строки кода: приложение умеет резать дорожки, накладывать кроссфейды, сводить аудио и генерировать дикторский голос через MiMo-V2-TTS.
- Решать инженерные задачи. За 4,3 часа модель написала рабочий компилятор SysY на Rust, закрыв все 233 теста университетского курса, а в связке с симулятором ngspice за час рассчитала аналоговую схему стабилизатора напряжения.
- Беречь контекст и токены. В задачах агентского рассуждения система тратит на 40–60% меньше токенов на траекторию по сравнению с закрытыми коммерческими аналогами.
- Оптимизировать память. Гибридное внимание снижает объем памяти под KV-кэш почти в семь раз при работе с ультрадлинными текстами.
Цены и доступ
Веса в точности FP8 открыты под свободной лицензией на Hugging Face для развертывания через vLLM и SGLang. Для работы без локального железа доступно облако: модель подключена к AI Studio и API Platform по действующим тарифам Token Plan под тегом mimo-v2.5-pro.
Находка для технических директоров и пайплайн-разработчиков: модель легко встраивается в среды вроде Claude Code или OpenCode и позволяет собирать внутренние студийные утилиты, плагины и скрипты автоматизации на собственном сервере.

