NVIDIA выпустила открытую модель Nemotron 3.5 Lightning для постоянно работающих ИИ-агентов.
Это модель на 30 млрд параметров, из которых активируются только 3 млрд. За счёт этого скорость генерации до четырёх раз выше, чем у моделей сопоставимого размера.
В PinchBench она показала точность 86% и выполнила 10 000 задач на 35% быстрее Qwen3.6 35B при сопоставимой точности.
Модель можно дообучить на собственных данных, инструментах и рабочих процессах. Она достаточно компактна, чтобы запускаться на DGX Spark.
Вместе с ней NVIDIA открыла NeMo Switchyard - библиотеку, которая распределяет разные этапы работы агента между моделями. Сложные рассуждения и планирование можно отдавать передовым моделям, а массовое выполнение задач - быстрой Lightning.
NVIDIA также опубликовала веса, данные и рецепты обучения.
Доступна бесплатно через OpenRouter.
Post #3673
25.2K
