Qwen-Image-2.0
Генератор картинок с честным 2K, версткой длинных текстов и объединением создания и правки в одной модели

Текстовые блоки внутри нейросетевых картинок долго напоминали случайный набор букв, а аккуратную верстку инфографики все равно приходилось собирать руками. Создатели Qwen-Image-2.0 свели в единую архитектуру две параллельные ветки разработки — чистую генерацию кадров и их последующее редактирование. Модель принимает подробные промпты объемом до 1000 токенов и сама компонует сложные макеты: от многоколоночных отчетов с десятками табличных параметров до кинематографичных афиш со строгим блоком титров.
Что умеет
- Нативное разрешение 2K. Выдает картинки размером 2048×2048 пикселей с проработкой фактуры ткани, пор кожи, архитектурных деталей и листвы без обязательного внешнего апскейла.
- Плотная типографика. Удерживает связный текст на разных физических поверхностях — стеклянных маркерных досках, одежде, книжных обложках и металле с учетом бликов и перспективы.
- Вложенные композиции. Создает структуру «картинка в картинке» для презентационных слайдов, сохраняя внешность и детали объекта при показе изменений.
- Интеллектуальная верстка. Модель распределяет массивные текстовые блоки и каллиграфию по свободным зонам изображения, избегая наложения на ключевые фигуры.
- Объединенный пайплайн. Позволяет запрашивать генерацию с нуля и контекстное редактирование готовых кадров внутри одного легковесного алгоритма без переключения инструментов.
Нас подкупило, с какой педантичностью модель выдерживает сетку: буквы не плывут, а надписи естественно вписываются в оптику сцены. Пожалуй, арт-директорам, дизайнерам презентаций и авторам раскадровок станет заметно легче собирать черновые макеты без ручной подгонки шрифтов в графических редакторах.


