其实,Open AI 和非人公司还没有注意到另外一件事情。。。
商汤通过异构混合推理,端到端算力电力协同优化等乱七八糟的技术已经把推理成本在大幅度降低。
具体技术细节你们自己搜搜,反正现在主流国产芯片MFU提升85%-152%,单位成本Token产出提升2.5倍,目前国产推理芯片的商业模型,已经开始转正。
如果说 kimi k3 是对闭源模型的打击,那么这种加速算力优化的进展就是对这些闭源模型公司和英伟达搞得加速算力基建的釜底抽薪。
为了全人类的安全所以必须发展领先的闭源模型,这个前提本来就高度不靠谱。然后私募阶段资本对闭源模型做垄断定价就更加不靠谱。然后闭源模型,加速算力提供商,显卡供应商再弄个循环吃屎,推动万亿美金的加速算力基建就是不靠谱上的不靠谱。而最终所有这些故事,又都跑到公开市场上通过英伟达甲骨文SpaceX再次上杠杆。。。
故事是很性感,但是中国作为过去 40 年真正干事情的人拿到这个故事,一项一项检查的时候。。。
模型,加速算力成本,显卡,商业落地,
这一项项,都会教美国做人。
而我就期待万亿美金的美国加速算力基建,赶紧落地,转化为真正的工厂,电厂,显卡,散热,储能配套。
然后,商汤拿着异构推理,混合显卡,电算协同的新一代加速算力中心方案,开开心心的告诉美国人:
你们的蒸汽机耗能太高,成本不合算。。。
要不要再凑一笔钱,给升级成内燃机的???