

性能、价格、速度。










坦率的讲,我本来对MiMo不报有啥预期的,因为他们太久太久没动静了,V2.5已经是4月的事了,而现在,已经9月底了。
你很难想象,一个模型厂商,在5个月的时间里,几乎没有新的大模型发布。
但是,今天深夜,MiMo-V2.6终于来了,一共三个版本。
MiMo-V2.6-Pro、MiMo-V2.6-Flash、还有一个20倍速的MiMo-V2.6-Pro-UltraSpeed,目前应该是全球最快的了。
然后,我自己体验完之后,我想说。
这个我本来不报有期待的,却给我了最大的惊喜。
先看跑分。
我写这篇稿子的时候,AA上刚刚更新了MiMo-V2.6的成绩。
46分。

跟Grok 4.7完全打平,位列开源模型第一和国产第一。
虽然不知道这个第一能维持多久,但,MiMo V2.6 Pro,就是当下的第一。
从V2.5的26分,进步到如今V2.6的46分,这个提升,还是挺猛的。
他们所有的细节跑分都在这。

不过这都是他们自己的,看看就行了。
AA上那两个我比较看重的,代表Coding Agent能力的Terminal-Bench 4.0和代表科研推理能力的CritPT,就是刚才Grok 4.7拉完的那两个,MiMo V2.6 Pro是这样的。

硬核的Coding Agent任务,MiMo在开源模型里面,仅次于GLM-5.3这个究极强化Coding能力的变态,还有刚刚强化过的Qwen 3.8 Max,位列第三。

但是在这个CritPt科研推理任务上,MiMo V2.6 Pro居然仅次于GPT和Claude这两个大魔王,成为了得分最高的模型。
在其他的各项任务上,也基本是在前列。

其次是价格上,MiMo V2.6 Pro,缓存输入每百万Token 0.025元,Flash直接就是0.02了,直接是跟DeepSeek V4.1 Flash对标,而且没有什么优惠期、没有什么闲时价格一说,就是0.025和0.02元,这个价格有多离谱,用AI比较多的同学一定懂的。。。

输入和输出价格,也超级低,甚至你用非实时可以等着的批量推理方式,你的价格,还能给你打半折。。。
我把一些主流大模型的价格,都换算成人民币,给大家列了一下,大家就知道,MiMo的价格有多离谱了。

小米真的是价格屠夫,DeepSeek在小米面前,突然都有点不够看了。。。
不仅是智能和价格有优势,这玩意的输出速度,还贼快。。。

怎么就干到130 Token/s了。。。
所以,当这三个数据摆出来的时候,大家就知道,为啥我说,我心中的不可能三角,在这个版本里,好像是属于MiMo V2.6的了。

我自己内部跑了一下AIHOT精选的小测试,想看看MiMo V2.6 Flash能不能进来,充当我的后端模型。
然后直接跑了2000道题,没想到,MiMo V2.6 Flash品味分第一,速度和价格跟DeepSeek V4.1 Flash打平,给我一下子整不会了。

已经正在无脑把AIHOT背后的一些主要的判断API,全面切换到MiMo V2.6 Flash上了。
至此,梁圣降级为梁子,罗圣正式上位。
而大模型斩杀线,也被MiMo V2.6,再次扩大了一步。

小米这次这个模型,做的确实好,是真的好。
MiMo V2.6这一次,其实也并没有把参数规模再疯狂往上堆,基座用的还是V2.5那个。

你可以直接看它现在训练到第几步,可以看到花了多少钱,可以看到每一步跑了多少数据,训练Pass Rate怎么变等等等等。

MiMo V2.6 Flash这一轮强化学习,花了大约85万美元。
Pro花了262万美元。
加起来差不多347万美元,也就是人民币两千多万。
就为了这不到6天的后训练。


网址在此:
https://huggingface.co/XiaomiMiMo/MiMo-V2.6-Pro-RL/blob/main/MiMo_V2_6_technical_report.pdf
罗福莉也写了一篇帖子。

You Only RL Once的思路真的很有意思。
如果想体验MiMo V2.6的话,今天你也有了更好的产品来用。
MiMo桌面客户端,结束了内测,也终于正式上线,出了正式版,向所有人正式开放。
网址在此:https://mimo.xiaomimimo.com/desktop/

你直接打开MiMo的客户端,就能看到,最新的模型,已经全部上线可用。

并且MiMo团队格局还贼大,直接可以配置自定义模型,并且贴心的,把各家国产模型都给预设好了。

这里如果你之前是买了MiMo的Token Plan的,也可以在这里直接添加,就可以继续在MiMo的客户端里,继续用了。
他们的客户端做的也非常的全面和完整,大家下下来以后,可以自己做一下设置。

我们自己也做了一些简单的测试。
基本上还是偏万能型的水桶模型的。
做一些小型的BUG修复,是绰绰有余的,比如说看到一个告警通知或者一个BUG反馈,直接就扔给MiMo V2.6 Pro,基本上3分钟就能定位到问题。

并且会更加主动一些,关联过去的一些问题,来告诉你,有没有还可以举一反三一起解掉的问题。

这个主动性,确实是这次MiMo V2.6的特性。
有一个热点算法的重构的大型任务,直接GPT-6 Pro做的规划,交给MiMo V2.6去执行了,目前还在跑,跑了1个多小时了,CI被打回了1次,正在修复准备继续提CI,感觉应该没啥问题。
在前端上,我们现在特别喜欢用建筑设计来测试,一方面可以测审美,另一方面也可以测代码性能。
在我们这个露天足球场的任务上,做的还不错,精细度和整体效果肯定是离GPT-6 Astra那种玩意有一些差距的,整体精细度和性能表现上,我觉得跟Opus 4.8~Opus 5之间。



然后还有一个特别有意思的:
MiMo-V2.6-Distill-Qwen-9B。
他们专门拿Qwen3.5-9B做了一个只有9B的小模型,就是为了让社区里没有几千张卡的人,也能自己去复现他们这一套Agentic RL。

并且,他们还宣布,会一起开放,7000多个高质量RL任务环境。
任何做AI的人,我相信大家都知道,这玩意,有多值钱。。。
MiMo就这么开了。
还有一个mini-harnesses的东西。
都开,全给你开。
那个全是宝藏的技术报告也开。
我只能说,今天罗圣登位。
愿未来,智能属于我们每个人。
以上,既然看到这里了,如果觉得不错,随手点个赞、在看、转发三连吧,如果想第一时间收到推送,也可以给我个星标⭐~谢谢你看我的文章,我们,下次再见。
>/ 作者:卡兹克、AIZ小朱
>/ 投稿或爆料,请联系邮箱:wzglyay@virxact.com