GitHub-радар

NVIDIA Nemotron 3.5 Lightning: агент у себя через Ollama

Открытая 30B-модель NVIDIA для постоянно работающих агентов с контекстом в миллион токенов теперь запускается локально через Ollama.

01nvidia/NVIDIA-Nemotron-3.5-Lightning-30B-A3B-NVFP4 360714k загрузок/мес30B параметровtext-generation

NVIDIA Nemotron 3.5 Lightning — открытая модель от NVIDIA для агентных задач: 30 миллиардов параметров, из которых в каждом шаге задействованы только 3 миллиарда. Создана для постоянно работающих агентов — личных помощников, автоматизированных рабочих процессов. Контекстное окно — 1 миллион токенов, что важно для долгих сессий. По данным NVIDIA, пропускная способность в 4 раза выше конкурентов аналогичного размера, а время выполнения задач — на 30% меньше. Для Apple Silicon доступна MLX-версия весом 23 ГБ. Запускается командой: ollama run nemotron-3.5-lightning.

Зачем это вайб-кодеру

Агентная модель с таким контекстом и скоростью раньше требовала серверных GPU. Через Ollama она запускается на Mac от 32 ГБ или мощной видеокарте — без облака и без API-ключей.

Как поставить

Скопируйте и отправьте своему агенту — Claude Code, Codex, любому:

Поставь мне NVIDIA Nemotron-3.5-Lightning локально: ollama run nemotron-3.5-lightning — и покажи, как настроить его как фонового агента для длинных задач

Нужен Mac от 32 ГБ памяти или видеокарта на 24 ГБ — MLX-версия весит 23 ГБ

Открыть на Hugging Face