全球卷疯AI4S!曙光8000走出国产算力差异化路子
闲的时候翻了美欧近些年的科技战略文件,感慨现在AI4S真的是大国必争之地。海外巨头大把砸钱,各种大算力项目层出不穷。网上讨论也总喜欢陷入老套路:拿单颗芯片性能来回掰手腕比高低。
但接触不少一线工程之后我越来越觉得,十万卡这个量级,单芯片远不是胜负全部。跨节点通信堵死、存储IO扛不住海量科研读写、硬件故障连锁扩散……随便哪一块短板,都能把纸面算力直接吃掉大半。
国外不是没有大集群,但也经常出现“卡很多,好用的不多”的尴尬。国内多家厂商都在攻坚系统工程,曙光8000这套全国产十万卡集群,是很有代表性的实践样本。
底层依托国产芯片打底,自研高速RDMA网络解决十万卡规模互联瓶颈;ParaStor存储拿下IO500双榜第一,扛住科学计算的海量读写压力;浸没相变液冷搞定高功率机柜散热能耗,再配套几百项行业应用深度调优。
实打实的产出摆在台面上:万亿原子量子精度分子动力学模拟,1000多项应用适配,覆盖创新药、新材料、航空、气象一大堆方向。
我个人一个很直观的判断,AI4S比拼到后面,能把庞大算力真正转化成科研、产业价值,才算拿到比赛的得分。
