Здесь (Инструменты)

Каталог ИИ-инструментов: что вышло, что умеет, сколько стоит и кому пригодится. Карточки пишет редакция по официальным сайтам.

Разноебесплатно

Muse Gadgets

Открытый софт для сборки собственных устройств и экранов с голосовым ассистентом Muse

Разноеплатно

MAI-Transcribe-2-Streaming

Потоковое распознавание речи на 60 языках с откликом от 100 мс для голосовых агентов и живых субтитров.

Разноеплатно

Mercury Voice

Диффузионная языковая модель для голосовых ассистентов с откликом от 320 миллисекунд

Разное

Eleven v4

Новая модель озвучки ElevenLabs, которая слышит паузы и эмоции сценария, а не просто читает текст

Разноеплатно

Jev

ИИ-модель первого типа для программ: быстрые типизированные решения вместо длинных текстовых ответов

Разное

Canto

Модель распознавания речи в реальном времени, рассчитанная на уличный шум и диктовку на ходу

Разноеесть бесплатный тариф

Mercury Books

Бухгалтерский учет прямо внутри банка с ИИ-помощником для автоматического закрытия баланса

Разноеплатно

Reception

Голосовой ИИ-администратор для круглосуточного приёма звонков и записи в календарь

Atria Dawn Preview
Разноебесплатно

Atria Dawn Preview

Текстовая агентная модель на 744 млрд параметров для исследований, кода и генерации отчётов

Разноеплатно

GPT-Live-1

Голосовая модель для API, которая умеет говорить и слушать собеседника одновременно.

Разноеесть бесплатный тариф

Mercury 2.5

Диффузионная языковая модель со скоростью свыше тысячи токенов в секунду для голосовых и поисковых сервисов

Разное

Muse Voice Transcribe

Потоковое распознавание речи с разметкой более 20 спикеров и поддержкой смены языков на лету

Разное

Router

Единый шлюз для маршрутизации запросов к нейросетям с защитой от сбоев и контролем расходов

Разноебесплатно

Kitesurf

Браузер от Cloudflare на базе Workers и Rust, созданный специально для автономных ИИ-агентов

Разноебесплатно

Inkling-Small

Открытая модель на 12 млрд активных параметров с нативным зрением, слухом и окном на миллион токенов

Разное

Lyria 3.5

Музыкальная модель от Google DeepMind: треки до трёх минут, вокал на разных языках и саундтрек по картинке

Разноебесплатно

Antares

Компактные открытые модели для поиска уязвимостей в кодовой базе без отправки исходников в облако

Разное

Sonic-3.6 & Ink-2

Связка генерации и распознавания речи для голосовых агентов с откликом до 90 миллисекунд.

Разноебесплатно

DiffusionGemma

Экспериментальная модель диффузии текста от Google для молниеносной генерации на локальных видеокартах

Разное

Gemini 3.5 Live Translate

Синхронный перевод речи в речь на 70+ языков с сохранением голоса и темпа спикера

AutoScientist
Разное

AutoScientist

Автоматическая доводка и синхронная оптимизация нейросетей размером от 0,8B до 8B параметров

Разноеплатно

GPT-Realtime-2

Голосовая модель с рассуждениями для живых ассистентов, вызова инструментов и синхронного перевода

Разное

Realtime TTS-2

Речевая модель для живого диалога с режиссурой интонаций через текстовые промпты

Разноебесплатно

Custom Voices

Быстрое клонирование голоса для озвучки и диалоговых агентов Grok с верификацией