Генерация 3D-сцен от Tencent: почему HY-World 2.0 пока рано нести в продакшен

Индустрия продолжает гнаться за идеей генерации целых игровых миров по одному текстовому промпту. Но чаще всего результатом становятся неоптимизированные ассеты, которые разваливаются при попытке добавить их в реальный рабочий процесс. Теперь Tencent выложила в открытый доступ HY-World 2.0 — мультимодальную модель, которая обещает решить проблему интеграции сгенерированного 3D в классические движки.
Разработчики заявляют, что система собирает интерактивные сцены из текста, изображений или видео. Вместо очередного закрытого API нам предлагают стандартизированный экспорт. Модель выдает меши, облака точек и сцены 3DGS для прямого импорта в Unity или Unreal Engine. Внутри даже предусмотрен интерактивный режим для навигации персонажа с базовым просчетом коллизий и физики.
Правда, практическая польза таких инструментов часто разбивается о технические ограничения. Получить геометрию в один клик здорово, но без правильной сетки и разделения на логические объекты редактировать такой уровень крайне сложно. Веса уже лежат на Hugging Face, так что сообщество быстро выяснит, применим ли этот генеративный хаос в настоящей разработке игр.
Поделиться:
Ещё из архива
Все публикации
Интервью с Владимиром Аюевым: графический язык бигтеха, студия SASHA и дизайн-образование
1 месяц назад
Jockey от TwelveLabs: ИИ-агент для семантического поиска по видеоархивам и извлечения метаданных
1 месяц назад
Архитектура винной этикетки: баланс наборного шрифта и каллиграфии в кейсе Winecraft
1 месяц назад
Оптимизация контекста в Claude Code: как работает кэширование промптов и за что мы платим
1 месяц назад
Архитектура памяти для LLM-агентов: от базового SQLite до Graph RAG
1 месяц назад