Топ трендов HuggingFace за неделю — разбираем, что нового
TL;DR
Новое: DiffusionGemma — первая крупная открытая диффузионная языковая модель, держит первое место. MiniMax-M3 — флагман на 428B под код и агентов с контекстом в миллион токенов. Nex-N2 — агентная линейка от китайского альянса, Pro и mini. Rio-3.5-Open — модель на 397B от мэрии Рио-де-Жанейро. North-Mini-Code — компактная кодовая модель от Cohere. Kimi K2.7 Code — свежая кодовая версия Kimi. SCAIL-2 — оживление персонажа по одному видео от Z ai.
Держится: LocateAnything-3B, Nemotron 3.5 ASR, Gemma 4, Higgs Audio v3, Ideogram 4, Qwen3.6 Uncensored, DeepSeek V4 Pro.
LLM и агенты
DiffusionGemma от Google — сейчас на первом месте трендов. Первая крупная открытая диффузионная языковая модель: пишет текст блоками сразу, а не по одному токену, отсюда скорость больше 1000 токенов в секунду. Подробный разбор был в отдельном посте.
MiniMax-M3 — новый открытый флагман MiniMax под кодинг и агентов. 428B параметров, из них на токен работают 23B, контекст миллион токенов, на вход берёт ещё и картинки с видео. Главное в новой схеме внимания MSA: на длинном контексте она считает в разы меньше, отсюда до 9 раз быстрее обработка запроса. На кодовых тестах вроде SWE-Bench Pro и Terminal-Bench идёт на уровне сильных закрытых моделей. Лицензия своя, для коммерции с условиями.
Nex-N2 — линейка открытых агентных моделей от китайского альянса Nex-AGI, обе на базе Qwen 3.5. Старшая Pro это 397B с 17B активных, младшая mini — 35B с 3B активных, контекст у обеих 262K. Фишка в том, что модель сама решает, когда думать глубоко, а когда отвечать сразу. По кодингу и долгим агентным сценариям заявляют уровень GPT-5.5 и Opus, и всё это под Apache 2.0.
Rio-3.5-Open-397B — а вот это любопытно: модель на 397B выложила мэрия Рио-де-Жанейро, точнее её ИТ-компания. Идея в цифровом суверенитете города, чтобы не зависеть от чужих API. Но в карточке честно написано, что Rio это мерж той самой Nex-N2-Pro и Qwen 3.5 с дообучением, а команда Nex-AGI и вовсе заявляет, что это просто смешивание весов двух моделей без своего обучения. Лицензия MIT.
North-Mini-Code — компактная кодовая MoE от Cohere, около 30B со 128 экспертами и 8 активными. Заточена писать код и работать агентом, бенчмарки заявлены по SWE-Bench и Terminal-Bench. Apache 2.0.
Kimi K2.7 Code от Moonshot — свежая кодовая версия Kimi, на кодинге держится на уровне GPT-5.5 и дешевле в API. Ревью разбирал на днях.
Видео
SCAIL-2 — модель от Z ai (это которые GLM), оживляет картинку с персонажем по видео-образцу: берёт движение из одного ролика и переносит на ваше изображение. Без скелетов и масок, умеет одного или нескольких героев, замену персонажа в кадре и даже животных. 14B параметров, до 704p, лицензия MIT.
Кванты и сообщество
Xiaomi выпустила MiMo-V2.5-Pro-FP4-DFlash — официальный квант своей триллионной модели: эксперты ужаты в 4-битный формат, плюс отдельный модуль ускоряет генерацию через спекулятивное декодирование. А вокруг свежих открытых весов привычно роятся энтузиасты: расцензуренная Gemma-4-12B-OBLITERATED, GGUF-кванты DiffusionGemma и Gemma 4 от Unsloth, кодовые файнтюны Gemma 4 12B и Qwen 3.6 27B под локальную работу.
Держится в топе
LocateAnything-3B от NVIDIA находит объекты на картинке по описанию, разбирал отдельно. Nemotron 3.5 ASR — потоковое распознавание речи с русским, тоже был отдельный пост. Из прошлых дайджестов держатся Gemma 4 12B (1,16M загрузок), Qwen3.6 Uncensored (2,7M), DeepSeek V4 Pro (2,93M), а также Higgs Audio v3 и Ideogram 4.
Хорошей недели! 👾
@neuro_channel
Post #2460
1.85K
- ❤ 8
- 👍 4
- 🗿 1