TGViewer
黑科技资源分享 黑科技资源分享 @deeptech123 · 3.54K subscribers
Post #4912 121
给大家带来小米 MiMo-v2.6-pro 的测试速报!
简单来讲, 这次不愧是直播RL带来的效果, AgenticCoding 能力提升明显, 之前的 MiMo-v2.5-Pro 在我的向量数据库测试中得分只有2505, 而这次直接翻了3倍, 得分来到了7810. 与 Claude Fable-5 分数接近了.
而且算法也进化为了单图HNSW分层近邻图(M=16/M0=28) + AVX-512精确距离 + 每线程visited stamp. 可以说只要再优化一下算法细节就是SOTA水平了.
而前端测试则是MiMo需要提升的重点了, 这次演示效果虽然有提升, 但是无奈横评的其他模型都太强大了, 而小米的加分项也是本身的算法Coding能力, 比如它是可以 one-shot 写出一个光追引擎的. 但是由于空间理解/物理模拟能力不到位, 小球没办法完成把墙壁撞破的演示.
另外本次还给大家测试了输出速度, MiMo-v2.6-pro-ultraspeed 版本可以达到464tps的速度, 着实恐怖. 而根据MiMo的技术报告, 峰值可以达到900tps,  常态化请求也可以稳定在500tps左右, 考虑到模型 1.02T 的总参数量, 以及高达 42B 的激活参数量, 再加上同等规模模型一般都在60-80tps的水平, 这个成绩相当亮眼.
当然也有值得注意的点, 比如这次测试我发现它还是有早停的问题的, 上面的向量数据库测试, 每轮最大迭代50次, 但是三次测试中, 有两次它迭代到30轮左右就没办法提升分数, 于是选择了直接交卷, 浪费了测试机会.
以及, 模型思考偏长, 而且暂时不支持调整思考强度, 加上普速接口现在异常火爆, 所以最好给大一些超时, 避免无法输出结果.
总结: MiMo-v2.6-Pro 适合搞后端AgenticCoding开发! 要算法有算法要质量有质量. 但是前端空间理解和美学还需要加强. 考虑到直播后训练的时候看到的67%的训练语料都是Coding, 这个结果丝毫不惊讶了. 希望下个版本前端能力也有提升!
#mimo #mimov26 #mimov26pro #x小米mimo
More from @deeptech123
  1. Oct 10, 2026酷啊!什么叫 3d 打印机器人?! 有西部世界那个味儿了!
  2. Oct 10, 2026把厂商锁死的 Android 相框和日历屏拿回控制权,刷上自己的启动器和家庭仪表盘。 https://github.com/wesbos/photo-frame-dashboard
  3. Oct 10, 2026卧槽,要什么 导演台,要什么 Blender! Threejs 就是最好的导演台! 上面 AI 视频,下面 Threejs 白模导演台。 先用代码排演船、飞机和镜头的运动,再把视频…
  4. Oct 10, 2026Apple Silicon Mac 的极简系统监视器:一块悬浮玻璃面板,任意尺寸都好看,安静不打扰。 https://github.com/Nongfsq/ftop
  5. Oct 10, 2026国行iPhone的软硬件定制,远比大家直观感受到的更深。硬件层面,受国内航空频段法规,Qi2无线快充限制在15W(海外版可达25W);单独开模做全球独有的双面实体双卡槽;硬件移除卫…
  6. Oct 10, 2026金融研究里事件、证据、因子、回测、风控这些环节散在五六个工具里,跑完一轮回头查不清哪份数据喂了哪个结果;这个工作台把它们放进同一条本地链路,每一步都挂上运行 ID 和数据指纹,最后…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →