youtu.be
Google выпустил Gemini Omni Flash: старшая Pro-версия для генерации видео уже в разработке

В релизе Gemini Omni от Google DeepMind есть деталь, которую легко упустить за демонстрацией новых функций. Сама нейросеть представляет собой серьезный апгрейд архитектуры Veo — она умеет на лету смешивать исходное видео, аудио и статические референсы для бесшовного редактирования через текстовые запросы. Но текущая открытая версия получила приставку Flash.
Разработчики подтвердили, что это лишь базовая, легковесная модель. Сейчас Google готовит к выходу старшую версию — Gemini Omni Pro. Если Flash-версия обкатывает саму механику работы с мультимодальными промптами, то Pro должна занять нишу сложного монтажа, повторив путь эволюции профессиональных нейросетей для генерации изображений.
Поделиться:
Ещё из архива
Все публикации
Интервью с Владимиром Аюевым: графический язык бигтеха, студия SASHA и дизайн-образование
1 месяц назад
Jockey от TwelveLabs: ИИ-агент для семантического поиска по видеоархивам и извлечения метаданных
1 месяц назад
Архитектура винной этикетки: баланс наборного шрифта и каллиграфии в кейсе Winecraft
1 месяц назад
Оптимизация контекста в Claude Code: как работает кэширование промптов и за что мы платим
1 месяц назад
Архитектура памяти для LLM-агентов: от базового SQLite до Graph RAG
1 месяц назад