Qwen3-Coder-Next
Открытая модель на 80 млрд параметров для кодинг-агентов и работы с гигантским контекстом
Архитектура Mixture of Experts экономит ресурсы рабочей станции: из общих 80 миллиардов параметров система активирует на запросе лишь 3 миллиарда. При этом на борту — контекстное окно на 262 144 токена, куда помещается код комплексного интерактивного проекта без риска потерять логику скриптов на полпути. Команда Qwen спроектировала эту открытую нейросеть специально для автономных программных агентов и локальной разработки.
Что умеет
- Держать в оперативной памяти до 256 тысяч токенов и самостоятельно выправлять сценарии после сбоев в исполнении кода.
- Работать с внешними инструментами через механизм вызова функций и стандартный API-интерфейс, совместимый с протоколом OpenAI.
- Генерировать чистый код без промежуточных служебных тегов размышления — модель функционирует только в non-thinking режиме.
- Встраиваться в готовые среды разработки и терминальные ассистенты, включая Claude Code, Qwen Code, Qoder, Kilo, Trae и Cline.
- Работать на собственном оборудовании через локальные сборщики вроде Ollama, LMStudio, llama.cpp, MLX-LM или серверные движки vLLM и SGLang.
Цены и доступ
Модель доступна бесплатно с открытыми весами на Hugging Face. Развернуть сервер можно на собственных видеокартах; если памяти не хватает, разработчики советуют уменьшить окно контекста со стандартных 256k до 32 768 токенов.
Для тех, кто собирает интерактивные инсталляции, скрипты автоматизации для 3D-пакетов или сложные шейдеры, это возможность получить толкового персонального программиста на локальной машине без постоянной платы за облачные токены.


