Mistral Small 4
Открытая мультимодальная модель на 119B параметров с регулируемой логикой и окном 256k

Вместо зоопарка из узкоспециализированных сеток Mistral объединила свои флагманские наработки в одном релизе под открытой лицензией Apache 2.0. Архитектура Mistral Small 4 соединяет мультимодальность Pixtral, логику Magistral и навыки программирования Devstral. Модель типа Mixture of Experts насчитывает 119 миллиардов параметров, но на каждый токен задействует лишь 6 миллиардов (8 миллиардов вместе со слоями эмбеддингов и вывода). Получился универсальный инструмент, готовый одновременно разбирать изображения, писать софт для автономных агентов и вести связный диалог в гигантском окне контекста.
Что умеет
- Работать с текстом и графикой: нативно принимает текстовые промпты и изображения, разбирая документацию или визуальный контент.
- Регулировать глубину рассуждений: через параметр reasoning_effort можно переключаться между быстрыми лаконичными ответами («none») и пошаговым глубоким анализом («high»).
- Экономить ресурсы на генерации: задержка сквозного вывода сократилась на 40%, а пропускная способность выросла втрое по сравнению с третьей версией модели.
- Удерживать 256 тысяч токенов контекста: справляется с глубоким анализом масштабных документов и кодовых баз.
- Разворачиваться на собственном железе: оптимизирована для vLLM, SGLang, llama.cpp и Transformers. Минимальный серверный сетап — 4x NVIDIA HGX H100, 2x HGX H200 или 1x DGX B200.
Цены и доступ
Веса опубликованы на Hugging Face под лицензией Apache 2.0. Бесплатно опробовать запуск модели в прототипах можно на вычислительных мощностях build.nvidia.com. Для интеграций модель доступна через Mistral API, платформу AI Studio, в виде контейнеров NVIDIA NIM и для дообучения через NVIDIA NeMo.
Креативным технологам и студиям автоматизации это даёт автономный визуально-текстовый комбайн, который можно забрать на свои серверы без оглядки на закрытые облака.

