Разработчики выпустили Qwen3.8-27B под свободной лицензией Apache 2.0. Это один из самых плотных открытых релизов за последнее время. Качество кода и работы с агентами выросло радикально: в тестах Software engineering показатели подскочили с 49,3 до 79,0. Благодаря оптимизированным GGUF-квантизациям от команды Unsloth, запустить 27-миллиардную модель можно на одной домашней видеокарте уровня RTX 3090!
Внутри архитектуры работает гибрид слоев Gated DeltaNet и Gated Attention, а генерация ускоряется за счет Multi-Token Prediction. Модель нативно мультимодальна — она обрабатывает не только текст, но и сложные визуальные данные, включая часовые видеоролики. Базовое окно контекста составляет 262 тысячи токенов, но при использовании методов масштабирования вроде YaRN его можно расширить до миллиона.
Отдельный фокус сделан на логике внутренних рассуждений. Встроенный режим Thinking включен по умолчанию, при этом глубину размышлений можно регулировать через параметр reasoning_effort или полностью отключать для экономии ресурсов. Улучшенный парсинг вложенных объектов позволил нейросети гораздо стабильнее вызывать внешние инструменты и работать в связке с агентными фреймворками.
Поделиться:
Тяжеловесная айдентика и плотная типографика: дизайн фестиваля уличной фотографии МОССФ
Qwen 3.8 от Alibaba: анализ новых моделей на 27B и 2.4T параметров