Китай снова в игре. Xiaomi выпустила убийцу Kimi/Qwen
⠀
Xiaomi выпустила MiMo-V2.6-Pro и MiMo-V2.6-Flash — две разреженные модели с архитектурой смеси экспертов и контекстом на 1 млн токенов. Они мультимодальны, принимают текст, изображения, видео и аудио, а выдают текст. Pro насчитывает 1,02 трлн параметров при 42 млрд активных, Flash — 309 млрд при 15 млрд активных.
⠀
Независимый индекс интеллекта AA оценил Pro в 46 баллов; Xiaomi приводит точное значение 46,32. На старте это первое место среди моделей с открытыми весами — выше Kimi K3 и Qwen3.8 Max. В общем зачёте выше стоят закрытые модели.
⠀
Официальная цена API за 1 млн токенов у Pro: $0.0435 за входные токены при попадании в кэш, $0.435 при промахе и $0.87 за выходные. У Flash — $0.014, $0.14 и $0.28 соответственно. Это те же тарифы, что у MiMo-V2.5. По всем трём позициям Flash обходится втрое дешевле.
⠀
AA также насчитала $0.13 за задачу по своей взвешенной методике индекса. Эта сумма относится к набору задач AA. Стоимость произвольного запроса определяют объём входа, длина ответа и использование кэша.
⠀
Xiaomi заявляет, что Pro при сопоставимом уровне интеллекта обходится в 20–60 раз дешевле зарубежных моделей. Такой диапазон зависит от выбранного закрытого флагмана и методики расчёта стоимости задачи. Для всех запросов и моделей единого коэффициента здесь нет.
⠀
Обучение с подкреплением для Pro заняло рекордные 5 дней 7 часов 29 минут — 127,5 часа. За 30 шагов модель обработала 75 млрд токенов и 753 тыс. траекторий, расходы составили $2,62 млн. Flash прошла свои 30 шагов менее чем за шесть дней и потребовала $0,85 млн.
⠀
Эти суммы покрывают только этап обучения с подкреплением. Xiaomi публиковала ход запуска вместе с расходами и сбоями: переполнением памяти GPU, дисбалансом нагрузки между экспертами, сетевой аварией и пропущенной инфраструктурной ошибкой у Flash.
⠀
Веса и технический отчёт уже доступны под лицензией MIT. Xiaomi также заявила об открытии кода обучения с подкреплением и более 7 тыс. сред с задачами. Отдельные прямые ссылки на эти репозитории в опубликованной коллекции пока отсутствуют.
⠀
Таблица самой Xiaomi показывает и победы, и крупные отставания. Pro набрала 53,1 в тесте автоматизации против 50,3 у Claude Opus 5 и 45,8 у GPT-5.6 Sol. В терминальном тесте 2.1 результат составил 89,9 против 89,1 и 88,8.
⠀
В DeepSWE модель получила 71,9 против 74,0 и 73,0. В терминальном тесте 4.0 — 34,9 против 49,0 и 39,9, а в тесте эксплуатации уязвимостей — 47,9 против 70,0 и 78,5. Универсального лидера в этой таблице нет.
⠀
MiMo-V2.6 от Сяоми заняла своё место на ИИ-олимпе: качество верхней лиги моделей теперь доступно с открытыми весами.
Политика открытого исходного кода моделей даёт свои плоды. Китайцы помогают, вставая на плечи друг друга, дотянуться до топовых фронтир-моделей США.
⠀
Источники: релиз Xiaomi · тарифы · ход обучения · оценка AA · веса
Post #547
413

- 🔥 5
- ❤ 1