NVIDIA Nemotron 3 Super: Рой агентов теперь не роскошь, а средство передвижения
NVIDIA выкатила модель, которая меняет математику мультиагентных систем. Вместо того чтобы греть облака одной огромной и дорогой нейросетью, Nemotron 3 Super позволяет запускать сотни ИИ-агентов параллельно — и это выходит в разы дешевле.
В чём фишка?
Представьте рой: один агент дебажит код, второй пишет тесты, третий штудирует документацию. Раньше такая «команда» стоила безумных денег или теряла нить разговора из-за перегруза данными. Nemotron решает обе проблемы разом.
Техническая магия:
• Эффективность: У модели 120 млрд параметров, но на каждый токен она активирует только 12 млрд. Это даёт бешеную скорость (в 7,5 раз выше Qwen3.5-122B) при низкой цене инференса.
• Память: Контекстное окно на 1 млн токенов. Агент держит в голове весь проект и не «забывает» задачу через пять шагов.
• Архитектура: Гибрид Mamba-2, трансформеров и новой технологии LatentMoE, которая сжимает данные перед обработкой, позволяя подключать в 4 раза больше экспертов.
На бенчмарках реальных задач (PinchBench) модель обогнала даже гигантов вроде Claude Opus 4.6 и GPT-5.4. Ну и вишенка на торте — всё открыто: веса, датасеты и полные рецепты обучения можно забирать и деплоить прямо сейчас.
Post #440
137