众力资讯网

牛来真来了,这性能野兽居然是智谱的

“牛来”终于被认领了——智谱家的GLM-5.3-Flash。

从上周五它匿名空降OpenCode开始,整个外网就疯了。

一个连名字都没有的模型,突然冲到调用榜第一,把DeepSeek连续56天的霸榜纪录给干碎了。大家全在盲猜,有人说是Gemini的小号,有人押小米MiMo,还有人跑去问OpenAI是不是他们偷偷练的新招。猜了一周没结果,网友索性给它起了个外号叫“牛来”——因为它实在太猛了,跟牛市冲顶一样拦不住。

结果今天早上智谱自己把马甲掀了。OxAlpha就是GLM-5.3-Flash,GLM系列首个原生多模态模型,1M上下文,主打Coding和Agent,直接MIT开源。

我看了下它的Visual Coding,确实跟别的模型不一样。不是那种看图识物的视觉,而是它能盯着自己生成的页面,发现布局歪了或者交互卡了,然后自己回代码里改。有人拿它从零做3D产品页,做风电岛模拟,甚至撸了一个能通关的横版小游戏,加了五六轮新功能之后前面的东西居然没崩——这点很多模型做不到,后面加需求前面就稀碎。

价格也够狠,能力对标Opus 4.8,但只收人家四十分之一。他们把激活参数压到18B,用了线性注意力和稀疏注意力的混搭,算得快还省显存。

最硬核的是——这玩意儿背后跑了10万张国产卡。实验环境跑通是一回事,全球开发者突然涌进来白嫖是另一回事,尤其多模态加长上下文加Agent任务,对调度和稳定性压力巨大。智谱说他们重新整了推理引擎,端到端性能提了三倍,单Token成本压到跟英伟达卡差不多。更有意思的是这套优化系统还让GLM-5.3自己帮了忙,模型给工程师指哪儿堵了,改完再扛更大的流量。

现在已经全开源了,API也直接能调。

从匿名空降全网猜,到今天亮身份开源,“牛来”这一波操作确实硬气。国产模型敢不报家门,直接上桌跟全球顶尖选手硬碰硬,还能稳稳接住各种测试,大模型赛跑这局比赛,越来越有看头了。

牛来 #牛来大模型 #智谱 #智谱AI #大模型 #GLM #GLM5 #大厂 #ai