По coding-бенчмаркам M3 обходит GPT-5.5 и Gemini 3.1 Pro. Нативная мультимодальность (текст + изображения + видео), контекст до 1M токенов.
Благодаря новой архитектуре MiniMax Sparse Attention (MSA) при контексте в 1 млн токенов модель тратит в 20 раз меньше вычислений на токен по сравнению с предыдущим поколением.
Модель уже доступна бесплатно в OpenCode, можно тестить.
Цена API: $0.60/M input и $2.40/M output до 512K токенов. Веса и техотчёт обещают примерно через 10 дней.
@ai_for_devs
