众力资讯网

深夜加班空余,再聊聊最近的AI模型。最近Flash这类中等模型,被DeepSee

深夜加班空余,再聊聊最近的AI模型。最近Flash这类中等模型,被DeepSeek-V4-Flash 0731开了个头,不过后来涨价了。后来就是Qwen3.8-Flash,还有最近智谱的GLM5.3-Flash。

这两天GLM5.3-Flash很火,因为能力也不错,应该是这三者最强的,而且特别便宜。但是目前推广期间的价格明显和当时的deepseek v4 flash 0731一样,没法持续的,想一直这个价格的就有点异想天开了,后面一定会涨价。如果以deepseek v4 flash作为新基准,比deepseek v4 flash贵是肯定的。

我们可以比一下硬件资源占用:DeepSeek-V4-Flash:总参数量为 284B,每个 Token 激活 13B 参数。GLM-5.3-Flash:总参数量为 320B,每个 Token 激活 18B 参数。Qwen3.8-Flash:总参数量为 125B,每个token激活6B参数。

当然GLM-5.3-Flash是最耗资源、最慢、也是最强的,对标Claude Opus 4.8,智谱官方也表示后面优化占用才是重点。但有趣的是,Qwen3.8-Flash 对标Claude Opus 4.6,在 SWE-bench Pro 上得分 62.5,在 Agentic Coding (DeepSWE 1.1) 上得分 58.7,均超越了 DeepSeek-V4-Flash。

而Qwen3.8-Flash资源需求差不多是DeepSeek-V4-Flash的二分之一;GLM-5.3-Flash的三分之一。

再换句话说,DeepSeek-V4-Flash一开始确实是量大管饱,后面确实涨的有点多;现在GLM5.3-Flash可以暂时平替了,但注定无法持续。可以说GLM5.3 Flash很强,现在这个暂时的优惠价格下也确实是日常高频下的无脑推。但是优惠结束,Qwen 3.8 Flash可以干到GLM5.3 Flash三分之一的价格,DeepSeek-V4-Flash二分之一的价格,轻轻松松。

所以Qwen3.8-Flash虽然现在虽然不温不火,才是这波Flash中等模型车轮战后真正的斩杀线。