NVIDIA выкатила Nemotron 3 Ultra.
550B MoE-модель с открытыми весами, заточенная под долгоживущих агентов.
По заявлениям NVIDIA:
• инференс до 5 раз быстрее
• до 30% дешевле на сложных агентных задачах
• сильнее в программировании, deep research и долгосрочном планировании
Главный фокус не на чатах, а на агентных сценариях, где модель часами планирует действия, вызывает инструменты, обрабатывает ошибки и принимает решения по следующим шагам.
Использует гибридную архитектуру Mamba + Transformer MoE, которая позволяет выполнять больше циклов рассуждений за то же время.
Из интересного:
• может работать с большими кодовыми базами
• держит длинные цепочки tool calls
• умеет собирать и синтезировать данные из сотен источников
• дообучалась под OpenClaw, Hermes Agent и LangChain
NVIDIA также открыла не только веса модели, но и синтетические датасеты вместе с рецептами постобучения.
И сразу приятный бонус.
Nous Research присоединилась к коалиции Nemotron и вместе с NVIDIA и Nebius открыла бесплатный доступ к Nemotron 3 Ultra через Nous Portal на две недели.
Для тех, кто хочет запускать модель локально, уже появились GGUF-квантизации от Unsloth
GGUF: тут
Guide: тут
😊😊😊
Post #3267
17.2K
