Новость

Black Forest Labs выпустила FLUX 3 с редактированием по десяти референсам

The image shows a triangular prism, made of clear glass, positioned on a gray surface. The prism is angled towards the right side of the image, casting a rainbow of colors onto the surface. The colors of the rainbow, from red at the top to violet at the bottom, are visible on the surface below the prism. The prism's fa
Фото: Replicate

Загружаешь в рабочее окно пару снимков готового флакона, просишь поставить его на влажный гранит в предрассветном свете — и сцена собирается заново без деформации этикетки. Команда Black Forest Labs представила генеративную модель FLUX 3, открыв к ней доступ на платформе Replicate. Главный акцент релиза сместился с создания абстрактных картинок с нуля на управляемую работу с готовым материалом: модель получила полноценный инструментарий многократного редактирования с опорой на референсы.

Архитектура FLUX 3 разделена на два базовых сценария. Первый — классический Text-to-Image, превращающий текст в изображение. Второй — Image Editing, где текстовый запрос накладывается на визуальную базу. Достаточно загрузить хотя бы один исходный файл, чтобы система автоматически переключилась в режим редактирования. Всего в один запрос можно отправить до десяти референсных изображений. Через них задаются стиль будущей работы, конкретный продукт или ключевой субъект кадра.

Параметры и входные данные

Модель принимает исходники в форматах jpeg, png, gif и webp. Разработчики установили понятные технические рамки: разрешение каждого референса должно быть не меньше 256×256 пикселей и не превышать порог в 16 мегапикселей. Это отсекает как совсем непригодные превью, так и чрезмерно тяжелые исходники, перегружающие пайплайн.

Управление генерацией строится через набор параметров, контролирующих геометрию, качество и поведение алгоритмов:

  • prompt — текстовое описание сцены или точечных изменений, которые нужно внести в загруженные файлы.
  • images — стек из референсов числом до десяти штук для удержания консистентности объекта или стиля.
  • aspect_ratio — диапазон пропорций кадра от кинематографичного 21:9 до ультравертикального 9:21. По умолчанию активирован режим auto: модель считывает пропорции из первого референса и текста.
  • resolution — итоговый размер выходного файла на выбор: 768sq, базовый 1k, а также 1.5k, 2k и 4k.
  • grounding — предварительный поиск по сети и базе картинок перед началом рендеринга. Тумблер активен по умолчанию, а его ручное отключение ускоряет генерацию в автономном режиме.
  • safety_tolerance — шкала модерации контента от 0 до 4, где ноль означает максимальную строгость фильтров, а четверка дает наибольшую свободу действий.
  • output_format и output_quality — экспорт в webp, jpg или png с возможностью настроить степень сжатия для форматов с потерей данных.

Нас подкупило, как в FLUX 3 устроен поиск grounding. Модель не просто вытаскивает визуальные ассоциации из весов, а предварительно сверяется с веб-поиском и релевантными изображениями в сети. Если перед вами стоит задача быстро набросать концепт с узнаваемыми элементами внешнего мира, эта связка заметно снижает риск получить бессмысленную кашу. Если же важна скорость отдачи на потоке, поиск можно выключить — автономный рендеринг идет существенно бодрее.

В практической работе с правками разработчики советуют отказаться от привычки переписывать сцену целиком. Эффективнее называть только конкретные метаморфозы — например, замену заднего плана или перекраску окружения. Оставив параметр aspect_ratio в положении auto, дизайнер гарантированно сохранит пропорции первого референса во всей серии генераций. Это избавляет от необходимости вручную выставлять пиксельные сетки под готовые макеты.

Разброс разрешений от превью-формата 768sq до полноценных 4k закрывает сразу несколько этапов производства. Быстрый черновой поиск композиции на низких значениях экономит время, а финальный апскейл до четырех тысяч точек позволяет отдавать результат сразу в верстку или под анимацию. Настройка safety_tolerance от нуля до четырех снимает раздражающие ложные срабатывания встроенных фильтров там, где в кадре требуется драматичный или сложный арт.

По-нашему, появление десяти параллельных референсов прямо меняет подход к коммерческому продакшену. Теперь не нужно мучительно собирать сложные составные промпты в надежде, что нейросеть удержит геометрию продукта на чистом описании. Вы просто скармливаете модели ракурсы объекта, задаете свет и получаете управляемый результат без многочасовой ручной доработки.

Случайные удачи генераций наконец-то уступают место строгому контролю над каждым пикселем сцены.

Ещё новости

Все новости →