刚刚,在AI行业里,火了整整一周的匿名神秘模型 OX Alpha,终于摘下了面具。
它就是智谱刚刚发布的 GLM-5.3-Flash。

8 月 20 日,OX Alpha突然出现在了OpenRouter和OpenCode上,100万上下文,多模态,完全免费试用,然后就没有任何其他信息了。

接下来几天,它直接冲到了两个平台的第一名。
同时,也让整个AI圈,开始疯狂竞猜这个模型到底是谁家的。
哦对了,这款模型在社区里,还有个中文名。
牛来。
主要是Ox等于牛,然后,也不知道是谁做了这个海报。

于是,牛来这个名字,就开始深入人心了。
无数人在问,牛来到底是谁家的。
有人猜是小米MiMo,有人猜是智谱,有人猜是Grok。
甚至Gemini的都来凑一份热闹。

然后被人也不知道为啥,被人一路狂喷。
当然,也有硬核用户用分词的方式,扒拉出来,这玩意百分百是智谱的。

反正社区就是一顿吵,吵得越狠,热度越高,大家反而更想知道这个牛来是谁家的。
到了今天晚上,谜底终于揭开。
OX Alpha就是GLM-5.3-Flash。
这是一个总参数320B、每次激活18B的MoE 模型,也是GLM-5系列第一个原生多模态模型。
对,原生多模态,智谱的GLM终于也有眼睛了,而且,它支持图像、视频和文本输入,原生上下文100万。
你没看错,视频也支持了。
而且我也不知道他们为啥要给这个模型命名为GLM-5.3-Flash。
因为,这个模型,是一个全新的预训练模型,使用了30万亿Token的多模态预训练数据,根本不是那种把GLM-5.3简单蒸馏以后搞个小的模型。
其实讲道理,我觉得GLM-5.5-flash这种名称,才更适合,也不知道他们为啥取个5.3-Flash。
智谱真是命名鬼才。
跑分上看,在这个体积之下,非常不错。

能力基本逼近Opus 4.8,在Terminal-Bench 2.1 上,它拿到84.3,接近Opus 4.8的85.0;DeepSWE 1.1是63.4;Toolathlon是78.4;Agents' Last Exam是26.3。
智谱内部的Z.ai Code Bench 里,GLM-5.3-Flash 在最高思考档拿到 29.0,Claude Opus 4.8是29.5。
而在这一段时间的Ox的匿名测试中,社区里的反馈也一致的好评,跟Opus 4.8的这个感觉对得上。
但我知道,你可能会说,这都2062年了,Fable 5.1都要出来了,你咋还对标Opus 4.8啊?
我想说,你不能抛弃价格和成本来看待这个事。
这一次,智谱GLM-5.3-Flash最震撼的,我觉得就是价格。

每百万Token输入0.8元、输出2.8元。
而且还有两周限时优惠,截止到2026年9月9日24:00,直接半价,输入 0.4元,输出1.4元,缓存输入是0.115元。
这个价格是什么概念呢,我们直接对比一下过去一致被称为大模型斩杀线的DeepSeek V4系列。

输入和输出比最便宜的DeepSeek V4 Flash在空闲时段的价格还要便宜一半,不过这块有一说一,Deepseek的缓存黑科技还是有一些东西的。
而能力上,这个GLM-5.3-Flash的能力,还要比DeepSeek V4 Pro还要强一大截。

这就有点太离谱了。
而跟其他同能力等级的模型进行对比。

我觉得这根柱子,就可以看出价格有多低了,而且同时智能水平又非常能打。
今天,GLM-5.3-Flash发了之后,我已经能在很多地方看到这段话了。

牢唐我觉得今天可以荣升唐圣,智谱看来也有自己的滑动变阻器了。
现在,全新的大模型斩杀线的图也正式亮相。

这个斩杀线覆盖的范围,真的越来越大了。
而且还有一个关键点是很多人所忽略的,就是GLM-5.3-Flash除了便宜之外。
过去这一周,他们匿名在OpenRouter和OpenCode上产生这一周的全部推理,是用了10万张国产卡,扛下来的。

他们针对国产芯片显存容量和带宽上的特点,重新优化了整套推理系统。
国产卡,如今这么大规模的实现了推理,抗住了一整周全球用户的免费流量,我觉得这个消息,比所有的东西都更加值得我们振奋。
讲道理,这可能是最近看到的,最让我开心的一个模型了。
而且可能很多老粉都知道,我自己业余时间,运营着一个给大家免费使用的公益网站,叫AIHOT。

现在的月活已经莫名其妙快逼近百万大关了,更别提有多少接我的AIHOT的免费API进行二次开发的了。
那我之所以敢这么给大家免费的用,是因为每个月的运营成本,是我自己扛得住且不肉疼的。
但自从DeepSeek8月17号官宣涨价,梁圣降为牢梁之后,我的AIHOT背后的运营成本,就巨幅上涨,模型层面的支出,每个月直接比翻倍还要多。
这是我AIHOT背后所有用到AI的地方,所用的模型。

几乎绝大多数都是DeepSeek,因为便宜,性价比最高。
我当然知道接Fable 5或者GPT-5.6 Sol之类的效果最好,但是代价就是,我一个月的光给AIHOT上用的API费用,就能烧掉六位数的人民币,未来我想把信源规模继续扩大,那就是继续乘倍数,一个月烧掉百万不是梦。
我除非是脑子被驴踢了我才会用这些最顶级模型来烧,我又不是王思聪。
所以我7月份的时候,还在群里说过。

结果,DeepSeek涨价了,涨到量级大了以后,我现在每天有点扛不住的阶段了,由俭入奢易,由奢入俭难啊。。。
而且,Pro更新以后,世界知识和品味我总觉得怪怪的,导致我自己觉得我整个精选的效果,我自己感觉都变差了。
所以被迫,我开始自建评测集,前几天,人肉标了将近1000条新闻资讯,准备开始全面评估一下现在模型的一些品味和世界知识,找到真正适合AIHOT的且成本我能抗住的模型。





以上,既然看到这里了,如果觉得不错,随手点个赞、在看、转发三连吧,如果想第一时间收到推送,也可以给我个星标⭐~谢谢你看我的文章,我们,下次再见。
>/ 作者:卡兹克
>/ 投稿或爆料,请联系邮箱:wzglyay@virxact.com