韩国科学技术院(KAIST)柳民秀教授团队近日发布全球首份AI代理能耗量化研究,结论足以让整个AI产业出一身冷汗:在采用700亿参数大模型的商用等级环境下,AI代理完成一次查询的平均耗电达348.41瓦时,是传统聊天机器人的136.5倍;响应延迟拉长最高153.7倍;作为运算核心的高端GPU,有多达54.5%的时间在空转等待外部工具返回结果。若按谷歌当前日均137亿次查询规模推演,AI代理全面铺开将需要约198.9吉瓦的瞬时电力,相当于美国全国平均总用电量的一半。该研究由柳民秀团队主导、博士生金智仁为一作,已于今年2月在计算机体系结构顶会HPCA上发表。
值得点明的是,136.5倍是Reflexion框架下的“峰值”,换成LATS框架数字降到约62倍,普通用户日常使用远达不到这个数量级。福布斯已提醒公众勿把峰值当均值。但这份研究真正刺眼的地方,不是那个被截屏疯传的倍数,而是GPU空转的比例。这意味着数据中心花大价钱采购的英伟达H100、B200们,超过一半的通电时间在“陪跑”,等着一个网页加载完成或者一段代码运行结束。
这是一种此前从未被认真定价的浪费。传统AI的能耗账,算的是模型推理本身;AI代理的账,还要加上模型停下来等外部世界的时间。当OpenAI的Operator、微软Copilot Agent、谷歌Project Mariner都在把“代替人类点几十下鼠标”作为下一代卖点时,他们同时也在把等待时间外包给了电网。
后果链条已经开始显现。国际能源署预计,全球数据中心耗电量到2030年将翻倍至约945太瓦时,接近日本全国用电量。爱尔兰数据中心用电占比已突破20%,弗吉尼亚州部分县出现电网并网排队数年的情况。若代理型AI按科技巨头描绘的节奏落地,这条曲线还要更陡。
真正需要监管者、云厂商和芯片设计公司回答的问题只有一个:在算力狂欢中,谁来为GPU的“空转小时”买单?如果答案继续是“先扩产,再修电网”,那这场智能革命的账单,最终会落在纳税人的电费单和被推迟关停的燃煤电厂上。