AI Radar
Support
LiveUpdated 2026-09-22 03:15 UTC

小米正式发布并开源 MiMo-V2.6 系列,包含 Pro 和 Flash 两个原生多模态模型。

小米正式发布并开源 MiMo-V2.6 系列,包含 Pro 和 Flash 两个原生多模态模型。 Pro 版在第三方评测机构 Artificial Analysis 的综合智能指数上拿到 46 分,超过 Kimi K3 和…小米正式发布并开源 MiMo-V2.6 系列,包含 Pro 和 Flash 两个原生多模态模型。 Pro 版在第三方评测机构 Artificial Analysis 的综合智能指数上拿到 46 分,超过 Kimi K3 和…

This is a AI post classified by Jev as Frontier models (a model release), kept by the AI Radar because it carries real work, not commentary.

小米正式发布并开源 MiMo-V2.6 系列,包含 Pro 和 Flash 两个原生多模态模型。 Pro 版在第三方评测机构 Artificial Analysis 的综合智能指数上拿到 46 分,超过 Kimi K3 和 Qwen3.8 Max,成为当前最强开源模型,同一天发布的 xAI Grok 4.7 也是 46 分,两者并列。不过和顶级闭源模型 Claude Fable 5.1、GPT-6 Astra 相比仍有差距。 这次发布最值得关注的,是背后的训练方法。MiMo 团队负责人 Fuli Luo 曾参与 DeepSeek R1 的研发,她说 V2.6 很可能是开源模型团队迄今为止单次规模最大的强化学习(RL)训练。Pro 模型跑了 30 个大步,覆盖约 75 万条训练轨迹,每条轨迹平均 11 万到 15 万 token,训练成本约 262 万美元。 换句话说,模型练的不是简单的一问一答,而是完整的、动辄几万步的 AI 智能体工作流程,写代码、调工具、查错、纠偏,整个链条都在强化学习中反复训练。 Fuli Luo 认为这次的研究创新和工程挑战超过了她此前参与的 DeepSeek R1。她提到团队采用了"MixRL"策略,把编程、视觉、网络安全等不同领域的任务混在同一个大规模 RL 训练中一起跑,而不是各跑各的再拼起来。那些验证困难或时间线极长的任务则单独训练,最后通过

Posted by 宝玉 (250k followers) 1 h ago · 30 likes · 7.3k views · view the original post on X. Kept by the AI Radar as Frontier models.

More AI work like this

Every post is read and classified by Jev (TypeSafe): what it is, which market it belongs to, and whether the link is a real tool. 40.9k posts from 5k X accounts over the last 14 days, 1.7k tools, 19 markets. Collected every 5 minutes, fully re-ranked every hour — last update 2026-09-22 03:15 UTC. Full method.