Исследователи из Contra Labs протестировали флагманские ИИ-модели на реальных задачах по веб-дизайну. GPT 5.6 Sol, Claude Fable 5, Grok 4.5 и Muse Spark 1.1 получили десять одинаковых брифов на создание лендингов. Девять практикующих дизайнеров вслепую оценивали готовые интерактивные страницы. Единого победителя нет. Результат зависит исключительно от формата ТЗ.
На открытых брифах с минимальными вводными побеждает GPT 5.6 Sol. Моделям давали только цель проекта и желаемое настроение. Нейросеть OpenAI выиграла 82% дуэлей. Проверяющие выделили сильную арт-дирекцию, работу с типографикой и палитрой. 61% таких страниц дизайнеры были готовы сразу презентовать клиенту. Остальные модели провалили абстрактные задачи. Их усредненный показатель пригодности составил всего 31%.
Рейтинг переворачивается при наличии жесткой спецификации. Как только в бриф добавляют сетку, веса шрифтов, палитру и тайминги анимаций, на первое место выходит Claude Fable 5. Доля готовых к релизу страниц у модели Anthropic взлетает с 31% до 72%. Sol в структурированных задачах падает на последнее место. Качество работы модели OpenAI вообще не меняется от детализации требований — она выдает те же 61% успешных результатов.
Выбор нейросети теперь диктуется форматом работы команды.
Sol действует как самостоятельный арт-директор. Модель отлично подходит для поиска визуального стиля с нуля. Fable работает как дисциплинированный верстальщик. Нейросеть требует строгих гайдлайнов, но безупречно собирает макет по готовой инструкции.
Поделиться:
Упаковка сладостей Filema Rodion: исторический леттеринг против реального ритейла
Архитектура пайплайнов с нуля: из чего состоит новая DevOps-программа на Stepik