Релиз интерактивной ИИ-модели Vidu S1 для потоковой генерации видео и создания цифровых аватаров

Компания Vidu представила интерактивную модель Vidu S1, предназначенную для генерации видео с цифровыми аватарами в реальном времени. Запуск проекта функционирует как прямой ответ на недавний релиз Runway Characters, при этом новая система поддерживает двустороннее голосовое взаимодействие и непрерывную потоковую генерацию с разрешением 540p при базовой частоте 25 кадров в секунду, которая может достигать 42 FPS.
Механика работы строится на использовании загруженного изображения и аудиоданных для клонирования голоса, в результате чего формируется персонализированный персонаж, способный реагировать на команды в процессе общения. Помимо базовой синхронизации губ, Vidu S1 позволяет подключать внешние текстовые документы в качестве корпоративной базы знаний и взаимодействовать с backend-RPC, что означает возможность интеграции цифровых людей в рабочие интерфейсы для выполнения конкретных задач.
Доступность открытого API и фокус на неограниченную потоковую генерацию указывают на постепенное смещение индустрии от создания заранее отрендеренных видеороликов к интерактивным сценариям. Способность модели обрабатывать голос пользователя и генерировать соответствующее поведение аватара без критических задержек формирует технический фундамент для развития автономных систем цифрового присутствия.
Поделиться:
Ещё из архива
Все публикации
Интервью с Владимиром Аюевым: графический язык бигтеха, студия SASHA и дизайн-образование
1 месяц назад
Jockey от TwelveLabs: ИИ-агент для семантического поиска по видеоархивам и извлечения метаданных
1 месяц назад
Архитектура винной этикетки: баланс наборного шрифта и каллиграфии в кейсе Winecraft
1 месяц назад
Оптимизация контекста в Claude Code: как работает кэширование промптов и за что мы платим
1 месяц назад
Архитектура памяти для LLM-агентов: от базового SQLite до Graph RAG
1 месяц назад