Принято считать, что генеративные модели скоро полностью избавят дизайнеров от ручного создания масок. Тренд на программное расслоение картинок действительно набирает обороты. Вслед за экспериментами от Qwen и Ideogram компания Bytedance запустила API Seedream 5.0 Pro Layerize. Инструмент берет плоское изображение и автоматически разбивает его на независимые элементы.
Под капотом процесс управляется не только визуальным анализом, но и текстовыми подсказками. Модель возвращает массив, где каждому вырезанному куску присвоен z_index и координаты bounding_box. За один вызов API отдает от 2 до 17 отдельных PNG-файлов с прозрачностью. Технически это позволяет быстро растащить сгенерированную композицию на фон, главных героев и мелкие объекты.
Но действительно ли это заменяет классическую работу с исходниками? Когда нейросеть изолирует объект на переднем плане, ей приходится гадать и дорисовывать перекрытые пиксели заднего фона. Сложные фактуры вроде полупрозрачного стекла или жидкостей тоже редко вырезаются без рваных краев и артефактов. Пока технология больше похожа на умный скрипт для сборки черновых драфтов, чем на полноценную замену слоям в профессиональных графических редакторах.
Поделиться:
ComfyUI-H3-FaceRefine: исправление генерации лиц на общих планах в MiniMax H3
Команда Qwen анонсировала мультимодальную модель Qwen3.8-27B с управляемым режимом размышления