Компания xAI выпустила обновление видеомодели Imagine Video 1.5, добавив нативную генерацию в разрешении 1080p и систему множественных референсов. Теперь нейросеть способна создавать ролики длиной до 15 секунд как исключительно по текстовому промпту, так и на основе стартовых данных, что позволяет точнее контролировать визуальную составляющую итоговой сцены.
Основной фокус обновления направлен на консистентность персонажей и окружения при смене планов. Инструмент поддерживает загрузку до семи референсных изображений на одну генерацию, где каждое фиксирует отдельный элемент — лицо героя, конкретный продукт или архитектуру локации. При этом разработчики интегрировали поддержку аудио: связка фотографии персонажа и голосового сэмпла обеспечивает сохранение единого визуального образа и звучания во всех сгенерированных фрагментах.
Доступ к новым функциям открыт через API с использованием модели grok-imagine-video-1.5. Стоимость генерации напрямую зависит от выбранного разрешения и составляет 0.08 $ за секунду хронометража в 480p, в то время как рендер в 1080p обойдется в 0.25 $ за секунду, что определяет базовую экономику интеграции инструмента в сторонние производственные пайплайны.
Поделиться:
Синематик Marathon от Патрика Клэра: процедурная киберпанк-анимация в геймдеве
Первая модель Safe Superintelligence: что стоит за слухами об августовском релизе