TGViewer
very vibe coding very vibe coding @veryvibecoding · 122 subscribers
Post #710 30

Forwarded from Data Secrets

Новый день – новые модели: Nvidia выпустили прекрасную Nemotron 3 Nano

В ней 31.6B параметров, но активных всего 3.6B (это MoE). Запустить можно на 24ГБ RAM. Зафайнтюнить – на 60ГБ VRAM.

Контекст – 1 миллион токенов.

По метрикам, внимание, обходит Qwen3-30В-А3В-Thinking и GPT-oss-20B-А4В. Получается, модель не просто конкурентоспособная, но и лучшая в своем классе на многих основных бенчмарках: SWE-bench, GPQA и др.

И еще – моделька очень шустрая, выдает больше 350 токенов в секунду. Это в 2-3 раза быстрее того же Qwen.

Nvidia умеют удивлять.

Веса (+датасеты!) | Статья | Блогпост

P.S. Любителям опенсорса напоминаем, что сегодня также ждем новенькую Gemma-3
More from @veryvibecoding
  1. Oct 7, 2026Google выпустила EmbeddingGemma 2. Это первая открытая мультимодальная модель для эмбеддин…
  2. Oct 7, 2026Еще от OpenAI. После скандалов с тем, насколько всем зарезали лимиты, компания начала разд…
  3. Oct 7, 2026OpenAI доказала кучу каких-то теорем, включая квази гипотезу Римана (гипотеза доказана не…
  4. Oct 6, 2026Есть все-таки польза от Grok Bot - поставил на нем агента, который контролирует расход под…
  5. Oct 6, 2026Мне кажется, я догадался, что может произойти. Надо просто уменьшить размер токена в полто…
  6. Oct 6, 2026Первое улучшение - скорость. Оно и правда требовалось, работают моделька очень долго. Но п…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →