Veo 3.1
Генерация видео со звуком, склейкой шотов и точным контролем сцены по референсам

Когда из видеогенератора выпадала немая картинка с плывущими текстурами, моушн-дизайнерам приходилось собирать звук на монтаже с нуля и мириться с пластиковыми лицами. Google выкатил модель Veo 3.1, встроенную в творческую среду Flow. Она точнее следует текстовому запросу, правдоподобнее передаёт естественные текстуры и сразу создаёт синхронный звук к происходящему в кадре.
Что умеет
- Сборка сцены по референсам (Ingredients to Video). Загружаете набор исходных картинок — персонажей, стиль или конкретный предмет — и модель генерирует шот с заданными элементами, сразу сопровождая его звуком.
- Морфинг между кадрами (Frames to Video). Достаточно задать стартовое и финальное изображения, чтобы система выстроила между ними плавный переход.
- Продление хронометража (Extend). Сцену можно удлинять шагами, опираясь на последнюю секунду предыдущего отрезка, и собирать непрерывные пролёты длиной в минуту и дольше.
- Врезка объектов (Insert). В готовый клип прямо в интерфейсе Flow добавляются новые элементы — от фоновых деталей до фантастических существ. Модель сама рассчитывает тени и подгоняет свет под окружение.
- Удаление лишнего (Remove). Заявлена функция очистки кадра от персонажей или предметов с автоматической дорисовкой скрытого фона.
Доступ
Модель Veo 3.1 работает внутри веб-инструмента Flow, интегрирована в приложение Gemini, а также открыта через Gemini API и облачную платформу Vertex AI для корпоративных задач.
Для арт-директоров и специалистов видеопродакшена это шаг к предсказуемому превизуализационному пайплайну: связка точечных референсов и родного аудио экономит часы рутины на сборке концептов и аниматиков.
