Mistral OCR 3
Распознавание сложных документов, таблиц и рукописного текста с экспортом в Markdown и JSON

Знакомая боль любого продакшена — пересобирать верстку из присланных клиентом мятых сканов, брифов и таблиц с объединенными ячейками. Mistral OCR 3 берет эту рутину на себя: модель вытаскивает текст и встроенные изображения из PDF и картинок, аккуратно превращая их в чистый Markdown или структурированный JSON.
Что умеет
- Разбирает сложную верстку. Восстанавливает таблицы любой запутанности с заголовками и объединенными ячейками через HTML-теги с параметрами colspan и rowspan.
- Читает от руки. Разбирает рукописные заметки, пометки на полях поверх печатного текста и курсив.
- Понимает бланки и формы. Точно считывает чеки, инвойсы, поля ввода и плотную служебную верстку.
- Терпит плохие сканы. Справляется с перекосами, сжатием, артефактами, низким разрешением и фоновым шумом.
- Сохраняет изображения. Извлекает встроенную графику прямо из тела документов.
Цены и доступ
Инструмент доступен в веб-интерфейсе Document AI Playground внутри Mistral AI Studio с простой загрузкой перетаскиванием, а также через API под идентификатором mistral-ocr-2512. Базовый тариф — $2 за 1000 страниц, а пакетная обработка через Batch-API со скидкой 50% обходится в $1 за 1000 страниц. Для компаний со строгими правилами безопасности предусмотрена возможность развернуть модель на собственной инфраструктуре.
Командам, которые строят пайплайны на базе нейросетей, оцифровывают архивы или готовят входящие документы для дизайн-агентов, эта модель сбережет немало рабочих часов.


