TGViewer
Нейроканал Нейроканал @neuro_channel · 11.7K subscribers
Post #2460 1.85K
Топ трендов HuggingFace за неделю — разбираем, что нового

TL;DR

Новое: DiffusionGemma — первая крупная открытая диффузионная языковая модель, держит первое место. MiniMax-M3 — флагман на 428B под код и агентов с контекстом в миллион токенов. Nex-N2 — агентная линейка от китайского альянса, Pro и mini. Rio-3.5-Open — модель на 397B от мэрии Рио-де-Жанейро. North-Mini-Code — компактная кодовая модель от Cohere. Kimi K2.7 Code — свежая кодовая версия Kimi. SCAIL-2 — оживление персонажа по одному видео от Z ai.

Держится: LocateAnything-3B, Nemotron 3.5 ASR, Gemma 4, Higgs Audio v3, Ideogram 4, Qwen3.6 Uncensored, DeepSeek V4 Pro.


LLM и агенты

DiffusionGemma от Google — сейчас на первом месте трендов. Первая крупная открытая диффузионная языковая модель: пишет текст блоками сразу, а не по одному токену, отсюда скорость больше 1000 токенов в секунду. Подробный разбор был в отдельном посте.

MiniMax-M3 — новый открытый флагман MiniMax под кодинг и агентов. 428B параметров, из них на токен работают 23B, контекст миллион токенов, на вход берёт ещё и картинки с видео. Главное в новой схеме внимания MSA: на длинном контексте она считает в разы меньше, отсюда до 9 раз быстрее обработка запроса. На кодовых тестах вроде SWE-Bench Pro и Terminal-Bench идёт на уровне сильных закрытых моделей. Лицензия своя, для коммерции с условиями.

Nex-N2 — линейка открытых агентных моделей от китайского альянса Nex-AGI, обе на базе Qwen 3.5. Старшая Pro это 397B с 17B активных, младшая mini — 35B с 3B активных, контекст у обеих 262K. Фишка в том, что модель сама решает, когда думать глубоко, а когда отвечать сразу. По кодингу и долгим агентным сценариям заявляют уровень GPT-5.5 и Opus, и всё это под Apache 2.0.

Rio-3.5-Open-397B — а вот это любопытно: модель на 397B выложила мэрия Рио-де-Жанейро, точнее её ИТ-компания. Идея в цифровом суверенитете города, чтобы не зависеть от чужих API. Но в карточке честно написано, что Rio это мерж той самой Nex-N2-Pro и Qwen 3.5 с дообучением, а команда Nex-AGI и вовсе заявляет, что это просто смешивание весов двух моделей без своего обучения. Лицензия MIT.

North-Mini-Code — компактная кодовая MoE от Cohere, около 30B со 128 экспертами и 8 активными. Заточена писать код и работать агентом, бенчмарки заявлены по SWE-Bench и Terminal-Bench. Apache 2.0.

Kimi K2.7 Code от Moonshot — свежая кодовая версия Kimi, на кодинге держится на уровне GPT-5.5 и дешевле в API. Ревью разбирал на днях.

Видео

SCAIL-2 — модель от Z ai (это которые GLM), оживляет картинку с персонажем по видео-образцу: берёт движение из одного ролика и переносит на ваше изображение. Без скелетов и масок, умеет одного или нескольких героев, замену персонажа в кадре и даже животных. 14B параметров, до 704p, лицензия MIT.

Кванты и сообщество

Xiaomi выпустила MiMo-V2.5-Pro-FP4-DFlash — официальный квант своей триллионной модели: эксперты ужаты в 4-битный формат, плюс отдельный модуль ускоряет генерацию через спекулятивное декодирование. А вокруг свежих открытых весов привычно роятся энтузиасты: расцензуренная Gemma-4-12B-OBLITERATED, GGUF-кванты DiffusionGemma и Gemma 4 от Unsloth, кодовые файнтюны Gemma 4 12B и Qwen 3.6 27B под локальную работу.

Держится в топе

LocateAnything-3B от NVIDIA находит объекты на картинке по описанию, разбирал отдельно. Nemotron 3.5 ASR — потоковое распознавание речи с русским, тоже был отдельный пост. Из прошлых дайджестов держатся Gemma 4 12B (1,16M загрузок), Qwen3.6 Uncensored (2,7M), DeepSeek V4 Pro (2,93M), а также Higgs Audio v3 и Ideogram 4.

Хорошей недели! 👾

@neuro_channel
  • ❤ 8
  • 👍 4
  • 🗿 1
More from @neuro_channel
  1. Sep 20, 2026Tencent выложила WeVisDoc, модели на 2 и 4 млрд параметров, которые превращают снимок стра…
  2. Sep 19, 2026StepFun выпустила Step 5 Preview, и Artificial Analysis уже её замерили: 44 балла в индекс…
  3. Sep 19, 2026На следующей неделе ожидается сразу несколько крупных релизов. Расскажу про самые интересн…
  4. Sep 18, 2026Qwen выложила Qwen3.8-Omni-Flash: на вход текст, картинки, звук и видео, контекст 1M токен…
  5. Sep 18, 2026PrismML выпустила Ternary Bonsai 2 27B: тернарное сжатие теперь сделано поверх Qwen3.8 27B…
  6. Sep 17, 2026Стелс-модель Union Alpha раскрылась: это Pareto 26.9 от компании The Unbiased Company. Вче…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →