На каждый деньбесплатноMistral AI

Mistral Small 4

Открытая мультимодальная модель на 119B параметров с регулируемой логикой и окном 256k

Фото: mistral.ai

Вместо зоопарка из узкоспециализированных сеток Mistral объединила свои флагманские наработки в одном релизе под открытой лицензией Apache 2.0. Архитектура Mistral Small 4 соединяет мультимодальность Pixtral, логику Magistral и навыки программирования Devstral. Модель типа Mixture of Experts насчитывает 119 миллиардов параметров, но на каждый токен задействует лишь 6 миллиардов (8 миллиардов вместе со слоями эмбеддингов и вывода). Получился универсальный инструмент, готовый одновременно разбирать изображения, писать софт для автономных агентов и вести связный диалог в гигантском окне контекста.

Что умеет

  • Работать с текстом и графикой: нативно принимает текстовые промпты и изображения, разбирая документацию или визуальный контент.
  • Регулировать глубину рассуждений: через параметр reasoning_effort можно переключаться между быстрыми лаконичными ответами («none») и пошаговым глубоким анализом («high»).
  • Экономить ресурсы на генерации: задержка сквозного вывода сократилась на 40%, а пропускная способность выросла втрое по сравнению с третьей версией модели.
  • Удерживать 256 тысяч токенов контекста: справляется с глубоким анализом масштабных документов и кодовых баз.
  • Разворачиваться на собственном железе: оптимизирована для vLLM, SGLang, llama.cpp и Transformers. Минимальный серверный сетап — 4x NVIDIA HGX H100, 2x HGX H200 или 1x DGX B200.

Цены и доступ

Веса опубликованы на Hugging Face под лицензией Apache 2.0. Бесплатно опробовать запуск модели в прототипах можно на вычислительных мощностях build.nvidia.com. Для интеграций модель доступна через Mistral API, платформу AI Studio, в виде контейнеров NVIDIA NIM и для дообучения через NVIDIA NeMo.

Креативным технологам и студиям автоматизации это даёт автономный визуально-текстовый комбайн, который можно забрать на свои серверы без оглядки на закрытые облака.

Сайт Mistral Small 4

Ещё на каждый день

Вся категория →
На каждый день

Gemini 4 Argon

Флагманская модель Google DeepMind для сложного кода, многошаговых процессов и кибербезопасности

На каждый деньплатно

GPT-6.1 Sol

Модель с контекстом в миллион токенов и производительностью уровня Astra по сниженной цене

На каждый деньплатно

Claude Opus 5.5

Флагманская модель для кода, автономных агентов и анализа данных — быстрее и на 40% дешевле Opus 5