存储圈炸了!中科曙光又扔下一枚核弹
今年存储圈的大消息不少,但能让我专门跑来数博会追着看的,ParaCache词元加速方案肯定算一个。
中科曙光刚拿下IO500全球生产型全节点和10节点两大榜单第一,随后又把ParaCache端了出来。这就有点意思了:IO500证明它能把数据送得足够快,ParaCache则更进一步,开始把已经完成的计算结果留下来,直接给后续推理复用。
现场把逻辑弄明白以后,我确实有点兴奋。过去我们说存储,脑子里都是盘、容量、带宽,始终像算力旁边的“后勤部门”。ParaCache一上来,存储开始决定哪些KV Cache留在显存,哪些下沉到内存和SSD,哪些进入分布式存储,还能跨卡、跨节点、跨请求调用。它不只保存数据,连模型已经算过的“记忆”也一起管了。
这一步有多猛?120K长文本下,首词元时延最高砍掉98.5%,高并发Token吞吐量最大提升27倍。存储第一次如此直接地影响一秒能产出多少Token。
再看赛迪的数据,中科曙光已经处在中国分布式存储领导者象限,AI存储连续三年第一,教育存储连续四年第一,在自动驾驶和具身智能市场同样领先。前面市场、技术和场景都铺好了,现在ParaCache相当于沿着这条路继续杀进推理核心区。
可以说,这不只是曙光多发了一套方案,而是国产存储的价值边界被往前推了一大截。以前比谁存得多、读得快,接下来还要比谁能让大模型少重算、多产Token。这场新比赛,已经开打了。
中科曙光

