众力资讯网

国产算力新里程碑!Kimi K3发布即适配华为昇腾,万亿MoE模型落地提速:【0

国产算力新里程碑!Kimi K3发布即适配华为昇腾,万亿MoE模型落地提速:

【0day极速适配,开启原生协同新时代】2026年7月27日,月之暗面正式发布Kimi K3——全球首个开源的3万亿参数混合专家(MoE)大模型。就在同一天,华为昇腾宣布完成对该模型的全链路0day适配。这意味着开发者在模型发布的“第0天”,即可在华为昇腾平台上进行部署与验证,彻底告别了过去“先发布、后移植”的漫长等待,实现了国产算力与大模型的原生协同迭代。

【攻克三大技术瓶颈,解锁万亿参数训练效率】面对Kimi K3高达2.8万亿参数的庞大体量及独特的架构设计,华为昇腾团队通过软硬协同优化,成功解决了三大核心难题:一、算子计算密度不足: 针对Kimi K3特有的KDA混合线性注意力机制,华为自研GEMM分组矩阵算子,大幅提升计算效率。二、海量专家负载失衡: 面对896个专家模块仅激活16个的挑战,采用FSDP+EP混合多维并行策略,将专家参数精准拆分部署,有效解决多卡显存溢出与负载不均问题。三、显存压力巨大: 依托MindSpeed MM训练套件,在Atlas 800 A3及Atlas 900 A3 SuperPoD硬件上实现全流程稳定训练复现。

【构建软硬一体生态,提供完整落地范式】此次合作不仅是一次简单的适配,更是国产算力生态成熟度的体现。硬件底座: Atlas系列算力硬件配合灵衢UB集群连接方案,构建了低延迟、高带宽的万卡级超节点集群,满足大规模专家并行的严苛网络需求。软件栈全覆盖: 训练端使用MindSpeed MM套件,推理端集成vLLM Ascend与SGLang引擎,打通了从训练到推理的全生命周期工具链。

这一突破标志着国产算力在万亿级稀疏MoE大模型领域实现了关键跨越,加速了中国AI基础设施的自主化进程,意味着国产算力替代英伟达又迈出了关键一步。

KimiK3华为昇腾国产算力人工智能大模型