众力资讯网

阿里今天把Qwen3.8扔出来了,2.4万亿参数,MoE架构激活95B,跑分我就

阿里今天把Qwen3.8扔出来了,2.4万亿参数,MoE架构激活95B,跑分我就不多聊了,反正榜单数字又涨了一截。

说一个细节。

Qwen3.8从一个空文件夹出发,独立编程运行了16天,做出了一个真实可用的开源项目「oh-my-cli」,全程没人碰过。

代码已经扔在GitHub上了,整个过程开着记录器跑的,每一步都公开可查,你自己去看。

你知道这事最让我起鸡皮疙瘩的是什么吗?

两年前,顶级的模型能帮写函数、补代码,当个称职的助手,两年后的今天,它自己立项、自己架构、自己写、自己跑、自己修bug、自己交付。这啥概念?全程自动化吗?

Arena全球排行榜也佐证了这件事,Qwen3.8排第二,仅次于Claude系列,PaperBench编程智能体评测直接跳了28.2分,录到93分。

这个量级的跃升,很难用一句「优化得好」盖过去,更像是模型本身摸到了一种新的工作方式。

还有几个场景,我看完也觉得非常有意思,

法务团队忙活一周的文档标注,它一小时扫完,篮球数据分析师逐帧拆八千多个攻防回合,它几十分钟出战术报告和教练报告。

最夸张的是金融那个。

量化团队靠很多年积累才跑通的ETF轮动策略,然后他自己调度并行智能体,几个小时从研究做到回测,做到盈利。

它的强大已经不是一句话可以盖过的了,感觉用它做法务投研数据分析,都不是啥大问题了。

价格也值得说一下。

国内每百万Tokens输入12块、输出36块,隐式缓存命中只要1块5,你看,阿里的姿势很明确,铺一个更便宜的基础设施。

对了,Qwen3.8-Max下周开源,27B版本一起放出来。

API先跑,开源跟上,这个双轨节奏挺聪明的,商业API吃即时变现,开源社区吃生态锁死,两条线都不想放。

不管怎么说,有一件事已经被锁定了,AI从「程序员笔下的产物」变成了「程序员身边干活的人」。

这个临界点,Qwen3.8把它踩实了。