NVIDIA Nemotron 3.5 Lightning
Быстрая открытая MoE-модель NVIDIA на 30 млрд параметров для рутинных вызовов в цепочках агентов

Держать тяжёлую рассуждающую нейросеть ради бесконечных вызовов терминала и форматирования таблиц накладно. NVIDIA собрала Nemotron 3.5 Lightning специально для черновой работы: это открытая MoE-модель с общим объёмом в 30 миллиардов параметров, из которых на каждый токен активируются лишь 3 миллиарда. Архитектура берёт на себя вал мелких задач в автономных пайплайнах — запускает скрипты, сверяет выводы инструментов и координирует вложенных агентов, оставляя сложное стратегическое планирование флагманским моделям.
Что умеет
- Отрабатывать быстрые сценарии агентов: архитектура изначально оптимизирована под связки вроде OpenClaw, Hermes Agent и защитный стек NemoClaw.
- Генерировать токены пачками благодаря встроенному спекулятивному декодированию (MTP) и чернововым моделям DFlash и DSpark.
- Запускаться локально на видеокартах уровня GeForce RTX 5090, модулях Jetson или настольных DGX Spark через знакомый софт вроде Ollama, llama.cpp, LM Studio и Unsloth.
- Экономить видеопамять с помощью готового формата квантования NVFP4 рядом со стандартным BF16 на видеокартах архитектур Ampere, Hopper и Blackwell.
- Дообучаться под кастомный продакшен через LoRA или полный SFT в инструментах NeMo, используя открытый датасет Nemotron-RL Agentic Terminal Pivot.
- Работать в связке с маршрутизатором NeMo Switchyard, принимая исполнение рутинных команд от сторонних планировщиков.
Цены и доступ
Модель полностью открыта. NVIDIA выложила веса, рецепты обучения и датасеты под свободной лицензией OpenMDW-1.1 на Hugging Face. Запускать инструмент можно бесплатно на собственном оборудовании либо разворачивать в облаках через партнёрские каталоги уровня Amazon SageMaker JumpStart и Google Cloud.
Если студия собирает автономных агентов для рутинной сортировки рендеров, проверки метаданных или сборки ассетов, Lightning избавляет от раздутых счетов за API. Пожалуй, это практичный способ разгрузить дорогой контур и запустить исполнительную рабочую лошадку прямо на локальной рабочей станции.

