说真的,我刷到这个榜单的时候,挺吃惊的。
排第一的那个logo,是小米。
9月22号凌晨,小米开源了新一代大模型MiMo-V2.6系列。旗舰版MiMo-V2.6-Pro在Artificial Analysis上拿了46分,直接冲到全球开源大模型第一名。后面跟着的是智谱GLM-5.3(45分)和Kimi K3(44分)。前三名,全是国产。
但更让我意外的不是分数,是价格。Flash版每百万输入Token只要1块钱,Pro版也才3块钱。什么概念?同等水平下,价格只有海外模型的二十分之一到六十分之一。而且小米这次没涨价,跟上一代定价一样。
关键是,半年前这个模型才26分。
上一代MiMo-V2.5-Pro得分26分,在榜单上根本排不上号。半年后直接干到46分,涨了20分。小米官方说靠的是强化学习算力扩展。Pro版训练花了不到6天,成本262万美元,Flash更便宜,85万美元。
而且,他们把整个训练过程公开了。你随时可以上网看模型怎么一步步变强的,哪一步翻车了、花了多少钱,全在账本上。
但分数高不等于能干活。在真实职业任务的JobBench测试里,MiMo-V2.6-Pro拿了62分,仅次于Claude Opus 5的65.7分,超过GPT-5.6 Sol的45.4分。在工具调用测试Toolathlon-Verified里,76.9分,直接超过GPT-5.6 Sol的74.9分。
模型还加了3D空间推理和计算机操作能力。在仿真环境里,它能用多视角相机控制机械臂抓东西、放东西。科研方面,它帮研究人员做了MOF材料筛选,还在Lean 4里完成了一个经典数学定理的完整形式化证明,写了6000多行代码,没专门训练过。
但得说清楚,46分是“开源第一”,不是“所有模型第一”。
总榜上,Claude Fable 5.1和GPT-6 Astra都是53分,比小米高7分。终端操作测试里,小米Pro是34.9分,GPT-6 Astra是59.6分,差距还不小。
不过把视野拉大一点看,这次排名释放的信号比小米本身更有意思。AA指数前十名里,国产开源模型占了大多数。小米、智谱、Kimi、阿里、DeepSeek全在榜上。中国公司在开源大模型这条赛道上,已经形成了集团优势。
半年前还是26分的模型,半年后就能冲到46分,价格还不涨。这种迭代速度,放全球都罕见。
至于小米能不能守住这个位置,智谱和Kimi的下一代什么时候反超——这场开源大模型的内卷大戏,才刚进高潮。
#小米 #开源大模型





