Black Forest Labs выпустила FLUX 3 с редактированием по десяти референсам

Загружаешь в рабочее окно пару снимков готового флакона, просишь поставить его на влажный гранит в предрассветном свете — и сцена собирается заново без деформации этикетки. Команда Black Forest Labs представила генеративную модель FLUX 3, открыв к ней доступ на платформе Replicate. Главный акцент релиза сместился с создания абстрактных картинок с нуля на управляемую работу с готовым материалом: модель получила полноценный инструментарий многократного редактирования с опорой на референсы.
Архитектура FLUX 3 разделена на два базовых сценария. Первый — классический Text-to-Image, превращающий текст в изображение. Второй — Image Editing, где текстовый запрос накладывается на визуальную базу. Достаточно загрузить хотя бы один исходный файл, чтобы система автоматически переключилась в режим редактирования. Всего в один запрос можно отправить до десяти референсных изображений. Через них задаются стиль будущей работы, конкретный продукт или ключевой субъект кадра.
Параметры и входные данные
Модель принимает исходники в форматах jpeg, png, gif и webp. Разработчики установили понятные технические рамки: разрешение каждого референса должно быть не меньше 256×256 пикселей и не превышать порог в 16 мегапикселей. Это отсекает как совсем непригодные превью, так и чрезмерно тяжелые исходники, перегружающие пайплайн.
Управление генерацией строится через набор параметров, контролирующих геометрию, качество и поведение алгоритмов:
- prompt — текстовое описание сцены или точечных изменений, которые нужно внести в загруженные файлы.
- images — стек из референсов числом до десяти штук для удержания консистентности объекта или стиля.
- aspect_ratio — диапазон пропорций кадра от кинематографичного 21:9 до ультравертикального 9:21. По умолчанию активирован режим auto: модель считывает пропорции из первого референса и текста.
- resolution — итоговый размер выходного файла на выбор: 768sq, базовый 1k, а также 1.5k, 2k и 4k.
- grounding — предварительный поиск по сети и базе картинок перед началом рендеринга. Тумблер активен по умолчанию, а его ручное отключение ускоряет генерацию в автономном режиме.
- safety_tolerance — шкала модерации контента от 0 до 4, где ноль означает максимальную строгость фильтров, а четверка дает наибольшую свободу действий.
- output_format и output_quality — экспорт в webp, jpg или png с возможностью настроить степень сжатия для форматов с потерей данных.
Нас подкупило, как в FLUX 3 устроен поиск grounding. Модель не просто вытаскивает визуальные ассоциации из весов, а предварительно сверяется с веб-поиском и релевантными изображениями в сети. Если перед вами стоит задача быстро набросать концепт с узнаваемыми элементами внешнего мира, эта связка заметно снижает риск получить бессмысленную кашу. Если же важна скорость отдачи на потоке, поиск можно выключить — автономный рендеринг идет существенно бодрее.
В практической работе с правками разработчики советуют отказаться от привычки переписывать сцену целиком. Эффективнее называть только конкретные метаморфозы — например, замену заднего плана или перекраску окружения. Оставив параметр aspect_ratio в положении auto, дизайнер гарантированно сохранит пропорции первого референса во всей серии генераций. Это избавляет от необходимости вручную выставлять пиксельные сетки под готовые макеты.
Разброс разрешений от превью-формата 768sq до полноценных 4k закрывает сразу несколько этапов производства. Быстрый черновой поиск композиции на низких значениях экономит время, а финальный апскейл до четырех тысяч точек позволяет отдавать результат сразу в верстку или под анимацию. Настройка safety_tolerance от нуля до четырех снимает раздражающие ложные срабатывания встроенных фильтров там, где в кадре требуется драматичный или сложный арт.
По-нашему, появление десяти параллельных референсов прямо меняет подход к коммерческому продакшену. Теперь не нужно мучительно собирать сложные составные промпты в надежде, что нейросеть удержит геометрию продукта на чистом описании. Вы просто скармливаете модели ракурсы объекта, задаете свет и получаете управляемый результат без многочасовой ручной доработки.
Случайные удачи генераций наконец-то уступают место строгому контролю над каждым пикселем сцены.


.jpg%3Fmode%3Dmax%26width%3D600&w=3840&q=75)