罗福莉带小米登顶全球开源榜首

新智元 · 经八阕原文

小米MiMo V2.6 Pro以46分登顶AA全球开源榜首,与同日发布的Grok 4.7同分,但单任务成本仅0.13美元,是后者的1/29。罗福莉披露,这是开源史上最大规模单次RL训练,投入262万美元、4000块GPU,并全程直播训练曲线。核心突破在于"MixRL"三轴协同:海量Rollout+多领域混合任务+Agentic精细评分器。

大模型江湖变天了。

9月21日,小米MiMo团队正式发布并全面开源新一代MiMo V2.6系列,一口气端出三款模型——Pro、Flash、Ultraspeed,直接改写全球开源模型的格局。

MiMo V2.6 Pro在Artificial Analysis智能指数(AA Intelligence Index v4.3)中拿下 46 分,超过Kimi K3和Qwen3.8 Max。

全球开源模型第一、国产模型第一!

拉出AA榜单横着看:Fable 5.1得分53,GPT-6 Astra得分52.8,Opus 5得分50.7。

MiMo V2.6 Pro虽然还没追平这几位「天花板」,但已经稳稳站进全球顶尖第一梯队,把其他所有开源模型甩在身后。

更狠的是,价格维持V2.5不变。

同样的钱,智能翻倍,直接画出一条新的「智能-成本」帕累托前沿。

别人还在打「斩杀线」的价格战,小米这一刀,直接把游戏桌掀了。

正好,小米大模型负责人罗福莉也在X上发了一篇长文——《The Hard Road to Scaling Up RL》。

她说MiMo V2.6很可能是开源世界迄今最大规模的单次RL训练,几十人团队把所有算力押在一件事上:强化学习究竟能扩展多远。

她甚至直言,这次RL的研究创新和工程挑战甚至「超过了DeepSeek R1」。

更巧的是,就在同一天,马斯克旗下 SpaceX的Grok 4.7也同步发布,马斯克兴奋转发。

但X上的风向转得比飞机还快。

AI博主Chubby(@kimmonismus)先夸了Grok 4.7,随后秒纠正——

真正该看的是MiMo V2.6。

他改口称:Better than Grok 4.7, much cheaper, and holy moly is China back!(比 Grok 4.7 更强,价格还便宜得多,我的天,中国回来了)

AA Intelligence Index上两者同为46分,但MiMo V2.6 Pro单任务成本0.13美元,Grok 4.7要3.74美元——近30倍差距。

同分,开源,全模态,便宜30倍。

社区的共识就五个字:又好又便宜。

三箭齐发:旗舰、效率、极速,各有杀招

MiMo V2.6是一个系列。针对不同工作场景,三款模型各司其职:

MiMo V2.6 Pro,是整个系列的绝对旗舰。

全模态、超高性能,覆盖复杂项目、长程任务、高价值工作,甚至能啃网络安全和科研的硬骨头。

放眼开源世界,它是唯一一个同时做到全模态和旗舰性能的模型。

AA智能指数46分,就是它交出的成绩单;在多数Agent Benchmark上,它已经能比肩Opus 5和GPT-5.6 Sol。

来源:新智元(经八阕转载) · 查看原文
Scroll for more