ЗДЕСЬ Медиа logo
huggingface.co

Открытая модель Qwen3.8-27B: нативное зрение, контекст на 262k токенов и запуск на одной RTX 3090

5голосов
от trainloop

Разработчики выпустили Qwen3.8-27B под свободной лицензией Apache 2.0. Это один из самых плотных открытых релизов за последнее время. Качество кода и работы с агентами выросло радикально: в тестах Software engineering показатели подскочили с 49,3 до 79,0. Благодаря оптимизированным GGUF-квантизациям от команды Unsloth, запустить 27-миллиардную модель можно на одной домашней видеокарте уровня RTX 3090!

Внутри архитектуры работает гибрид слоев Gated DeltaNet и Gated Attention, а генерация ускоряется за счет Multi-Token Prediction. Модель нативно мультимодальна — она обрабатывает не только текст, но и сложные визуальные данные, включая часовые видеоролики. Базовое окно контекста составляет 262 тысячи токенов, но при использовании методов масштабирования вроде YaRN его можно расширить до миллиона.

Отдельный фокус сделан на логике внутренних рассуждений. Встроенный режим Thinking включен по умолчанию, при этом глубину размышлений можно регулировать через параметр reasoning_effort или полностью отключать для экономии ресурсов. Улучшенный парсинг вложенных объектов позволил нейросети гораздо стабильнее вызывать внешние инструменты и работать в связке с агентными фреймворками.

Ещё публикации

Все посты
dprofile.ru

Тяжеловесная айдентика и плотная типографика: дизайн фестиваля уличной фотографии МОССФ

6colorblind32 минуты назад
huggingface.co

Qwen 3.8 от Alibaba: анализ новых моделей на 27B и 2.4T параметров

7mainbranch1 час назад
github.com

watermarks-remover: утилита для очистки текстов и файлов от скрытых AI-маркеров и метаданных

9cleancode2 часа назад
github.com

OpenSandbox от Alibaba: среда выполнения и изоляции для ИИ-агентов с поддержкой MCP

5runtime2 часа назад
github.com

Локальный генератор музыки Minimax Music 3 интегрировали в ComfyUI

6modeldrift2 часа назад
z.ai

GLM-5.3: как масштабирование RL дало скачок в кодинге и поиске уязвимостей

5overfit2 часа назад
Открытая модель Qwen3.8-27B: нативное зрение, контекст на 262k токенов и запуск на одной RTX 3090 - ЗДЕСЬ Медиа