MedGemma
Открытые медицинские ИИ-модели для анализа снимков, разбора выписок и клинических рассуждений

Семейство открытых моделей на базе архитектуры Gemma 3 от Google разработано для тех, кто строит цифровые сервисы и интерфейсы в сфере медицины и биотеха. Линейка объединяет мультимодальные и текстовые конфигурации разного масштаба: от компактной версии на 4 миллиарда параметров до старших на 27 миллиардов. Эти решения служат базовым фундаментом для прикладных продуктов, требуя предварительной проверки и точечной адаптации под конкретные сценарии.
Что умеет
- Читать сложные медицинские изображения. Мультимодальные версии отвечают на вопросы по визуальным материалам и составляют предварительные описания для томографии (КТ), МРТ, гистологических препаратов (WSI), а также помогают с анатомической локализацией.
- Разбирать документацию и выписки. Модель 1.5 4B извлекает структурированные показатели из неструктурированных лабораторных отчётов и помогает расшифровывать записи электронных медицинских карт (EHR).
- Ассистировать в клинических задачах. Старшая версия на 27 миллиардов параметров ориентирована на поддержку принятия решений, резюмирование анамнеза, проведение опроса пациента и сортировку обращений.
- Тонко настраиваться под проект. Систему можно адаптировать через разметку промптов с примерами (few-shot), дообучение через LoRA или обучение с подкреплением, раздельно обучая языковой декодер и работу с визуальными токенами.
- Встраиваться в агентные пайплайны. Модель умеет работать в связке с внешним поиском, генераторами формата FHIR, аудиодиалогами через Gemini Live или флагманскими системами вроде Gemini 2.5 Pro. В локальном контуре она способна парсить конфиденциальные данные пациента перед их обезличенной отправкой на облачные серверы.
По нашему мнению, инструмент в первую очередь оценят разработчики продуктов и продуктовые дизайнеры цифрового здравоохранения — те, кому нужно локально и безопасно протестировать интерфейсы работы со снимками или прототипы медицинских ассистентов.


