GLM-5.3能力再跃升,海光DCU首日接住
GLM-5.3这次最炸的,不是模型又大了一圈。参数量和基座架构基本没变,代码、网络安全和Agent能力却继续猛涨。
模型现在不只负责生成答案,还要自己分析问题、调用工具、操作终端、执行代码,再根据结果反复验证。一件任务跑下来,推理轮次更多、上下文更长,对底层算力的压力也更持续。
海光DCU在这个节点完成Day0适配,确实来得很及时。
它采用通用GPGPU架构,能够兼顾大模型训练与推理,并支持多种计算精度;DTK、DAS等软件栈则从算子、框架和硬件加速层面做适配优化。面对长链条Agent任务,海光要解决的不只是“模型能不能跑”,还包括吞吐能不能顶住、延迟能不能压下来、多轮任务能不能稳定完成。
此前海光DCU已经适配MoE、长上下文、代码生成等多类模型,如今超过400款主流模型的优化积累,正好可以继续承接Agent带来的新负载。
AI从聊天走向真正干活,背后的计算量只会越来越实在。海光DCU连续跟进GLM多代模型,显然已经盯上了这波长期增量。
GLM53 Agent 海光DCU 国产AI芯片
