Команда разработчиков Qwen опубликовала спецификации новой модели Qwen3.8-27B. Архитектура базируется на наработках поколения Qwen3.5 и представляет собой плотную языковую модель на 27 миллиардов параметров с нативной поддержкой обработки изображений и видео. Базовое контекстное окно составляет 262 тысячи токенов, при этом в облачной инфраструктуре лимит будет расширен до 1 миллиона токенов.
Ключевой особенностью релиза стала встроенная система управления когнитивной нагрузкой через параметр reasoning_effort. Модель по умолчанию работает в режиме размышления, генерируя промежуточные выводы перед итоговым ответом, что повышает надежность выполнения многошаговых агентных задач. Разработчики также реализовали функцию preserve_thinking, которая сохраняет контекст рассуждений из предыдущих сообщений, что позволяет системе лучше адаптироваться к обратной связи от среды при длительном планировании.
В основе модели лежит гибридная архитектура, сочетающая блоки Gated DeltaNet и Gated Attention, а этап постобучения включал механизм предсказания нескольких токенов одновременно. Подобные компактные открытые модели позволяют разворачивать полноценные мультимодальные системы на собственных серверах, что решает проблему аналитики и извлечения данных в закрытых корпоративных контурах с жесткими требованиями к приватности. Для интеграции в рабочие процессы заявлена совместимость с популярными движками вывода, включая vLLM и SGLang.
Поделиться:
Релиз Wan 3.0: мультимодальная генерация видео до 30 секунд в 1080p и запуск по API
ComfyUI-H3-FaceRefine: исправление генерации лиц на общих планах в MiniMax H3