Xiaomi MiMo в этот раз в цель
Кажется, у открытовесовых LLM новый лидер, прошлый дуэт Kimi K3 и GLM-5.3 продержался всего три с половиной недели.
Xiaomi выложила под лицензией MIT мультимодальные модели MiMo-V2.6 Pro и Flash. Флагманская Pro на 1020B параметров (42B активных) понимает текст, изображения, видео и аудио, контекст до 1 миллиона, Flash поменьше: около 310B и 15B активных. В Artificial Analysis Intelligence Index Pro набрала 46 баллов и стала лучшей среди открытых моделей: у Kimi K3 44, у лидеров среди закрытых 53, у предшественника MiMo-V2.5-Pro было 26.
Прирост в 20 баллов Xiaomi объясняет масштабированием RL: за неполные шесть дней каждая модель прошла 30 шагов на примерно 750 000 траекторий, обучение обошлось в $2,62 млн для Pro и $850 000 для Flash. Модель многословна, на прогон индекса у нее ушло 140 млн токенов, но одна задача из него обходится MiMo в $0,13 против $5,86 у Opus 5.
В таблице Xiaomi, собранной на собственном стенде компании, Pro обходит закрытых конкурентов в AutomationBench (53,1) и Terminal-Bench 2.1 (89,9), а на OSWorld-Verified и DeepSWE почти догоняет Opus 5: 82,0 против 83,4 и 71,9 против 74,0. На сложном Terminal-Bench 4.0 разрыв заметнее: 34,9 против 49,0 у Opus 5 и 59,6 у GPT-6 Astra. В ExploitBench результат 47,9 против 78,5 у GPT-5.6 Sol.
Помимо кода модель работает с интерфейсом ПК, собирает презентации, генерирует 3D-сцены в Blender и по камерам управляет симулированным манипулятором Franka Panda.
Xiaomi выложила веса техотчет. Цены API остались на уровне V2.5: у Pro $0,435 и $0,87 за миллион входных и выходных токенов, у Flash $0,14 и $0,28. Для быстрых ответов есть режим UltraSpeed: до 20 раз быстрее, но в 10 раз дороже.
В анонсе Xiaomi пишет, что Pro на уровне Claude Opus 5 и GPT-5.6 Sol в большинстве агентных бенчмарков. В ее же таблице счет 3:10 против Opus 5 при одной ничьей.
Веса
Репорт
@anti_agi
Post #2129
867

- 👍 9
- 🔥 3
- ❤ 1
- 🌚 1