小米正式发布并开源 MiMo-V2.6 系列,包含 Pro 和 Flash 两个原生多模态模型。

This is a AI post classified by Jev as Frontier models (a model release), kept by the AI Radar because it carries real work, not commentary.
小米正式发布并开源 MiMo-V2.6 系列,包含 Pro 和 Flash 两个原生多模态模型。 Pro 版在第三方评测机构 Artificial Analysis 的综合智能指数上拿到 46 分,超过 Kimi K3 和 Qwen3.8 Max,成为当前最强开源模型,同一天发布的 xAI Grok 4.7 也是 46 分,两者并列。不过和顶级闭源模型 Claude Fable 5.1、GPT-6 Astra 相比仍有差距。 这次发布最值得关注的,是背后的训练方法。MiMo 团队负责人 Fuli Luo 曾参与 DeepSeek R1 的研发,她说 V2.6 很可能是开源模型团队迄今为止单次规模最大的强化学习(RL)训练。Pro 模型跑了 30 个大步,覆盖约 75 万条训练轨迹,每条轨迹平均 11 万到 15 万 token,训练成本约 262 万美元。 换句话说,模型练的不是简单的一问一答,而是完整的、动辄几万步的 AI 智能体工作流程,写代码、调工具、查错、纠偏,整个链条都在强化学习中反复训练。 Fuli Luo 认为这次的研究创新和工程挑战超过了她此前参与的 DeepSeek R1。她提到团队采用了"MixRL"策略,把编程、视觉、网络安全等不同领域的任务混在同一个大规模 RL 训练中一起跑,而不是各跑各的再拼起来。那些验证困难或时间线极长的任务则单独训练,最后通过
Posted by 宝玉 (250k followers) 1 h ago · 30 likes · 7.3k views · view the original post on X. Kept by the AI Radar as Frontier models.
More AI work like this
- 如果真的是这样,我建议马斯克也做中转站,直接去小米进货,然后把 grok 路由到 MiMo,价格差了 14 倍,比你卖车赚钱多了🤣 — @dingyi
- 플루토 리서치에서 퍼왔습니다. 정말 이렇게 많이 차이가 나나요? — @joejo2038
- 感觉现在发模型只能走两个极端: — @op7418
- Congrats to Grok 4.7 and Xiaomi’s MiMo-2.6 Pro & MiMo-2.6 Flash 🎉 — @YouWareAI
- Grok 4.7 improves from 54% to over 60% on Vals Index after updating the SDK — @scaling01
- New cheap highly effective model just dropped. New frontier — @Perpetualmaniac
- Grok 4.7 vs 4.6, round 2. — @WescheNex1q
- Bro… Grok 4.7 made this entire game in minutes from just a single-line prompt. — @cb_doge
Every post is read and classified by Jev (TypeSafe): what it is, which market it belongs to, and whether the link is a real tool. 40.9k posts from 5k X accounts over the last 14 days, 1.7k tools, 19 markets. Collected every 5 minutes, fully re-ranked every hour — last update 2026-09-22 03:15 UTC. Full method.