众力资讯网

推理性能翻倍的新路子 2026中国算力大会上,移动云联合多家机构发布了国内首个国

推理性能翻倍的新路子
2026中国算力大会上,移动云联合多家机构发布了国内首个国产GPU加类脑芯片异构混合推理系统。实测在DeepSeek V4 Flash上,推理输出和能效均提升1倍以上,运营成本降40%。

跳出"只追制程"的思路

大模型推理爆发,传统单一GPU架构越来越吃力。内存墙、功耗墙、国内先进制程受限,单纯靠硬件升级空间有限。

核心思路是架构创新:把Transformer模型拆开,Attention交给天数智芯国产GPU,FFN交给灵汐科技类脑芯片。

各发挥所长

类脑芯片存算一体、片上大容量SRAM,像给数据建了"近水粮仓"。GPU负责通用并行和前处理,自研编译器做任务拆解协同。

实测数据

3台天数GPU服务器配3套类脑超节点,运行DeepSeek V4 Flash,较同规模纯GPU集群推理输出和能效翻倍,综合成本降40%以上。已获15项专利、6项软著,进入试产。

产学研打通全链条

整合运营商、芯片企业、高校力量,从芯片适配到场景验证走通完整链条。后续面向词元工厂、AI代码、文生视频等场景落地,核心框架逐步开放。

不依赖先进制程,也能跑通大模型推理。这条路在当前环境下可能更有现实意义。

推荐标签: 国产芯片 类脑芯片 异构计算 大模型推理