阿斯麦、台积电、英伟达,该睡不着了。7月13日,上海,一家成立不到三年的公司,用14nm工艺造出了一颗520TFLOPS的AI芯片,没用EUV,也没用HBM。
这家公司叫东方算芯,拿出来的芯片叫DF1000。别看公司年轻,动作却不小。按照公开信息,这颗芯片已经完成流片验证,不只是做出一个样品摆在台上,还把128张卡连在一起,跑通了整套系统。
它公布的单卡算力达到520TFLOPS,内存带宽达到6.4TB/s。这些数字听起来有点绕,简单理解就是,这颗芯片一边算得快,一边搬数据也快。
而AI芯片最怕的,恰恰不是不会算,而是数据送不过来。
英伟达这些年为什么厉害?除了芯片本身强,还有一个重要原因,就是它能让大量数据快速送进计算核心。
现在东方算芯做的事情,就是换了一种办法解决这个问题。别人通常是把高性能芯片和HBM高速内存放在一起,再用先进封装把它们连起来。
东方算芯没有这么干,而是把计算部分和存储部分上下叠在一起,让数据少跑路。
数据不用绕远路,芯片自然就能更快开工。
让人震惊的是,这颗芯片用的不是5nm,也不是3nm,而是14nm。
14nm放在今天,已经算不上最先进的工艺了。很多人一听到这里,第一反应可能是,这还能做高性能AI芯片?
结果东方算芯偏偏就是用相对成熟的工艺,把算力做到了520TFLOPS,还公布了6.4TB/s的内存带宽。
这件事真正有意思的地方,不是说14nm突然比3nm更先进了,而是证明了一个道理,造AI芯片不只有拼制程这一条路。
制程暂时追不上,可以从芯片结构上想办法。HBM不好拿,可以从存储方式上重新设计。
东方算芯现在走的,就是这条路。
过去很多人觉得,没有EUV光刻机,就做不了高性能芯片;没有HBM,就做不了大模型计算;没有台积电的先进封装,就很难搞出高端AI系统。
东方算芯这次拿出的答案是,不一定非要完全照着别人走过的路往前追。
正门被堵住了,可以找侧门。侧门也被堵住了,那就自己开一扇窗。
这才是最让阿斯麦、台积电和英伟达值得警惕的地方。不是说东方算芯今天就能抢走它们多少订单,而是中国芯片企业开始不再只盯着最先进制程死磕了。
以前大家想的是,怎样造出一颗和英伟达差不多的芯片。现在有人开始想,能不能换一种方法,做出一套适合中国自己的计算系统。这两种思路看着差不多,实际上完全不是一回事。
跟着别人跑,永远要看别人把路修到哪里。自己换一条路,虽然前面坑更多,但主动权在自己手里。
而且东方算芯不是只发布了一颗孤零零的芯片。
这家公司还拿出了加速卡、服务器和集群方案。也就是说,它想做的不是卖一块芯片,而是把芯片装进服务器,再把大量服务器连起来,最后真正用来运行人工智能模型。
这一步很关键。因为现在的大模型,早就不是一张卡就能解决的了。
训练一个大型人工智能模型,往往需要几百张甚至几千张芯片同时工作。单卡再强,彼此之间连不起来,照样没有用。
东方算芯把128张卡跑通,至少说明它不是只想在参数上制造一个新闻,而是在往真正的计算系统方向走。
我认为,这件事目前最值得看的,不是520这个数字,而是它背后的思路变了。过去外部限制想达到的效果,是让中国拿不到最先进设备,就只能停在原地。但现在越来越多中国企业开始发现,追不上最先进工艺,不代表什么都做不了。
先进制程当然重要,谁也不能否认。但芯片最终是拿来解决问题的,不是拿来参加制程数字比赛的。只要产品能稳定运行,成本能够接受,客户愿意使用,那它就有生存空间。
现在最需要警惕的,反而是另外一种声音。每当国内出现一款新芯片,总有人马上喊“世界第一”“彻底碾压”,结果后面产品还没量产,热度先过去了。这种吹法看着解气,实际上对产业没有好处。
DF1000到底能不能成功,还要看后续量产,看真实客户,看它能不能连续稳定运行,也要看下一代产品能不能按时出现。
这些关过不了,再漂亮的参数也只是纸面成绩。但同样的,也不能因为它暂时没有全面超过英伟达,就说它没有价值。
一家成立不到三年的中国公司,用14nm工艺,不靠EUV,不走传统HBM路线,做出一颗面向AI计算的芯片,还把128卡系统跑了起来,这本身就值得重视。
它至少让外界看到,中国AI芯片并不是只有一条被别人卡住的路。
今天是一家公司在尝试。明天可能就会有更多公司,从存储、架构、封装和芯片连接上寻找新的办法。一家公司的产品未必能改变行业,但一批公司同时换思路,就可能慢慢改变规则。
所以阿斯麦、台积电和英伟达真正该睡不着的,不是东方算芯已经追到了它们身后。而是中国企业正在学会一件事。别人不卖给你的东西,不一定只能等。别人设下的游戏规则,也不一定永远要跟。
