10万张国产卡撑起“牛来”,海光疑为最大赢家
“牛来”这个匿名模型火了五天后,智谱终于认领了——就是GLM-5.3-Flash。但真正让人好奇的反而不是模型本身,而是背后那10万张国产芯片到底是谁家的。
智谱官方没明说,只强调“全部由国产芯片提供算力支持”,还说硬件效率和单token成本已经达到与主流英伟达GPU相当的水平。这话信息量很大——能做到这个程度,说明这套集群绝非等闲之辈。
我搜了下现有的网上报道,大多供应商或来自华为、摩尔线程与海光。三方之中,我个人判断海光DCU的概率最大。为什么?线索其实有迹可循:今年6月GLM-5.2发布时,海光就实现了Day-0极速适配,双方还围绕长程任务与代码能力展开了深层优化。GLM-5.3的推理支持,海光大概率也是主力。
再说海光DCU本身的硬实力,优势很明显:兼容“类CUDA”环境,开发者几乎无需改代码就能迁移;已与国内外主流大模型全面适配;背后光合组织凝聚超6000家伙伴,生态底座扎实。
林外,还有个细节值得琢磨——智谱这次敢让全球开发者在OpenRouter和OpenCode上自由调用,免费测试期流量累计超过50万亿token,使用量甚至超过DeepSeek两倍以上。
如果不是对这套国产集群的稳定性和成本有绝对信心,谁敢这么玩?
