众力资讯网

全闪存卷到头了,中科曙光透露了存储的下一个战场 过去几年存储行业就一个字:快。全

全闪存卷到头了,中科曙光透露了存储的下一个战场
过去几年存储行业就一个字:快。全闪存渗透率从16.8%干到24.5%,NVMe、RDMA轮番上,大家都在比谁IOPS高、谁延迟低。
但“快”是有天花板的,这件事已经卷到头了。存储带宽喂饱GPU之后,真正的问题变成了推理侧的存储成本和KV Cache管理上。长上下文多轮对话场景下,KV Cache动辄几十GB甚至上百GB,存储成本急剧攀升;高并发推理服务对缓存读取速度的要求,比训练场景还要苛刻。
中科曙光的思路是再往上走一层,他们分布式存储产品部总经理石静在武汉召开的全球闪存峰会上透露,公司将于数博会发布基于存算协同理念的新一代词元加速方案。她提到几个场景,长上下文多轮对话、高并发推理服务、轻量级硬件部署等,都已经有突破了。
这个方向我是认可的。推理规模化之后,成本控制就是生命线。谁能帮客户把存储成本降下来,谁就是下一阶段的赢家。中科曙光的底子不错,ParaStor和FlashNexus都有硬实力,这次数博会到底能拿出什么方案,我挺期待。
中科曙光 数博会