TGViewer
Machinelearning Machinelearning @ai_machinelearning_big_data · 278K subscribers
Post #10224 23.6K
✔️ MiniMax показали тизер Sparse Attention для M3.

На 1M токенов - 9.7x ускорение префилла и 15.6x на декоде против M2.

В марте их лид по претрейну писал, почему для M2 откатились на full attention: эффективные варианты не были готовы к проду.

Спустя полгода готовы.

Схема двухстадийная. Сначала лёгкая index-ветка выбирает релевантные блоки KV. Дальше sparse attention считается только по ним, а не по всему контексту.

Дешёвый 1M-контекст в опенсорсе - это другой режим работы с длинным контекстом и другая экономика инференса для агентов.

Ждём техрепорт и замеры качества. Ну и приятно, что всё это в опенсорсе.

https://x.com/MiniMax_AI/status/2059286515155599595

#MSA #OpenSource #M3
  • 👍 60
  • ❤ 35
  • 👨‍💻 24
  • 🔥 8
  • 👏 8
  • 🎉 6
More from @ai_machinelearning_big_data
  1. Oct 5, 2026🏅 Нобелевку по медицине дали за то, что нейроны научились включать светом Премию по физио…
  2. Oct 5, 2026✔️ Китайские инженеры разработали неинвазивный нейроинтерфейс весом 3 грамма Исследователи…
  3. Oct 4, 2026✔️ Runway показала генеративную оболочку ОС Исследовательское подразделение Runway анонсир…
  4. Oct 3, 2026✔️ Anthropic открыла моды для Claude Code Моды – небольшие функции на TypeScript, меняющие…
  5. Oct 3, 2026⚡️ OpenAI обнулила лимиты платных аккаунтов ChatGPT Главный по ресетам в OpenAI сообщил, ч…
  6. Oct 2, 2026⚡️ Одна и та же модель набирает 62% в одном агентном харнессе и 33% в другом. Hugging Face…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →