Bytedance опубликовала официальную документацию для своей видеомодели Dreamina Seedance 2.5, описывающую логику взаимодействия с нейросетью. Модель поддерживает как классическую генерацию по тексту, так и сложный композитинг с использованием до 50 референсных материалов, включая изображения, видео и аудио. При этом система способна не только создавать новые сцены, но и редактировать существующий видеоряд, опираясь на заданные параметры и предоставленные исходники.
В основе управления генерацией лежит структурированный подход, напоминающий режиссерскую экспликацию. Разработчики предлагают использовать базовую формулу промпта, которая разделяет запрос на пять смысловых блоков: объект и его действие, окружение сцены, визуальный стиль, движение камеры или монтажные склейки, а также звуковое сопровождение. Подобная детализация позволяет контролировать крупность плана, текстуру материалов и интершум, что существенно снижает уровень случайности в итоговом результате.
Оригинальный документ Dreamina Seedance 2.5 Prompt Guide содержит примеры составления запросов и рекомендации по распределению лимитов для референсов разного типа. Параллельно китайское сообщество сформировало расширенную базу знаний по модели на платформе WaytoAGI, полноценный доступ к которой требует предварительной авторизации через экосистему Lark для обхода ограничений на перевод внутренних документов.
Поделиться:
Dreamina Seedance 2.5: генеративная видеомодель с поддержкой 3D-референсов и сценами до 180 секунд
Экономика и motion-дизайн анонимных YouTube-каналов на примере ниши looksmaxxing