TGViewer
Неискусственный интеллект Неискусственный интеллект @anti_agi · 5.4K subscribers
Post #2129 867
Xiaomi MiMo в этот раз в цель

Кажется, у открытовесовых LLM новый лидер, прошлый дуэт Kimi K3 и GLM-5.3 продержался всего три с половиной недели.

Xiaomi выложила под лицензией MIT мультимодальные модели MiMo-V2.6 Pro и Flash. Флагманская Pro на 1020B параметров (42B активных) понимает текст, изображения, видео и аудио, контекст до 1 миллиона, Flash поменьше: около 310B и 15B активных. В Artificial Analysis Intelligence Index Pro набрала 46 баллов и стала лучшей среди открытых моделей: у Kimi K3 44, у лидеров среди закрытых 53, у предшественника MiMo-V2.5-Pro было 26.

Прирост в 20 баллов Xiaomi объясняет масштабированием RL: за неполные шесть дней каждая модель прошла 30 шагов на примерно 750 000 траекторий, обучение обошлось в $2,62 млн для Pro и $850 000 для Flash. Модель многословна, на прогон индекса у нее ушло 140 млн токенов, но одна задача из него обходится MiMo в $0,13 против $5,86 у Opus 5.

В таблице Xiaomi, собранной на собственном стенде компании, Pro обходит закрытых конкурентов в AutomationBench (53,1) и Terminal-Bench 2.1 (89,9), а на OSWorld-Verified и DeepSWE почти догоняет Opus 5: 82,0 против 83,4 и 71,9 против 74,0. На сложном Terminal-Bench 4.0 разрыв заметнее: 34,9 против 49,0 у Opus 5 и 59,6 у GPT-6 Astra. В ExploitBench результат 47,9 против 78,5 у GPT-5.6 Sol.

Помимо кода модель работает с интерфейсом ПК, собирает презентации, генерирует 3D-сцены в Blender и по камерам управляет симулированным манипулятором Franka Panda.

Xiaomi выложила веса техотчет. Цены API остались на уровне V2.5: у Pro $0,435 и $0,87 за миллион входных и выходных токенов, у Flash $0,14 и $0,28. Для быстрых ответов есть режим UltraSpeed: до 20 раз быстрее, но в 10 раз дороже.

В анонсе Xiaomi пишет, что Pro на уровне Claude Opus 5 и GPT-5.6 Sol в большинстве агентных бенчмарков. В ее же таблице счет 3:10 против Opus 5 при одной ничьей.

Веса
Репорт

@anti_agi
  • 👍 9
  • 🔥 3
  • ❤ 1
  • 🌚 1
More from @anti_agi
  1. Sep 23, 2026«Я провела своё лето, вымаливая, занимая и воруя чипы» Деифицит компонентов из-за ИИ довод…
  2. Sep 23, 2026🤖 AID — AI-дайджест от @anti_agi Вчера Anthropic выпустила Claude Opus 5.5. Компания увер…
  3. Sep 23, 2026Anthropic теперь точно замедлится Через неделю после резонансного эссе Дарио Амодеи о том,…
  4. Sep 22, 2026Маленькие стартапы становятся ещё меньше благодаря ИИ Раньше путь технологического стартап…
  5. Sep 22, 2026🤖 AID — AI-дайджест от @anti_agi Meta* наконец-то на коне, кажется, впервые с выпуска Lla…
  6. Sep 21, 2026Яркая сторона ИИ На марафоне «Знание.Первые» в рамках Международного фестиваля молодежи ге…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →