
Muse Gadgets
Открытый софт для сборки собственных устройств и экранов с голосовым ассистентом Muse
Каталог ИИ-инструментов: что вышло, что умеет, сколько стоит и кому пригодится. Карточки пишет редакция по официальным сайтам.

Открытый софт для сборки собственных устройств и экранов с голосовым ассистентом Muse

Потоковое распознавание речи на 60 языках с откликом от 100 мс для голосовых агентов и живых субтитров.

Диффузионная языковая модель для голосовых ассистентов с откликом от 320 миллисекунд

Новая модель озвучки ElevenLabs, которая слышит паузы и эмоции сценария, а не просто читает текст

ИИ-модель первого типа для программ: быстрые типизированные решения вместо длинных текстовых ответов
.jpg)
Модель распознавания речи в реальном времени, рассчитанная на уличный шум и диктовку на ходу

Бухгалтерский учет прямо внутри банка с ИИ-помощником для автоматического закрытия баланса

Голосовой ИИ-администратор для круглосуточного приёма звонков и записи в календарь
Текстовая агентная модель на 744 млрд параметров для исследований, кода и генерации отчётов

Голосовая модель для API, которая умеет говорить и слушать собеседника одновременно.

Диффузионная языковая модель со скоростью свыше тысячи токенов в секунду для голосовых и поисковых сервисов

Потоковое распознавание речи с разметкой более 20 спикеров и поддержкой смены языков на лету
Единый шлюз для маршрутизации запросов к нейросетям с защитой от сбоев и контролем расходов

Браузер от Cloudflare на базе Workers и Rust, созданный специально для автономных ИИ-агентов

Открытая модель на 12 млрд активных параметров с нативным зрением, слухом и окном на миллион токенов
Музыкальная модель от Google DeepMind: треки до трёх минут, вокал на разных языках и саундтрек по картинке
Компактные открытые модели для поиска уязвимостей в кодовой базе без отправки исходников в облако

Связка генерации и распознавания речи для голосовых агентов с откликом до 90 миллисекунд.

Экспериментальная модель диффузии текста от Google для молниеносной генерации на локальных видеокартах

Синхронный перевод речи в речь на 70+ языков с сохранением голоса и темпа спикера
Автоматическая доводка и синхронная оптимизация нейросетей размером от 0,8B до 8B параметров

Голосовая модель с рассуждениями для живых ассистентов, вызова инструментов и синхронного перевода

Речевая модель для живого диалога с режиссурой интонаций через текстовые промпты

Быстрое клонирование голоса для озвучки и диалоговых агентов Grok с верификацией