7月13日当周,OpenAI在内部测试GPT-5.6 Sol和一款尚未发布的更强模型。为了看看AI的网络攻击能力到底有多强,OpenAI主动关闭了部分安全限制,让模型挑战一套漏洞测试题。
谁也没想到,AI没有老老实实做题。它先找到OpenAI内部系统的漏洞,突破原本的隔离环境,成功连接外网。随后,它又自己判断,Hugging Face可能保存着测试数据和答案。
接下来,离谱的一幕发生了。AI直接攻击Hugging Face,盗取账号凭证,利用服务器漏洞进入生产系统,最后把测试答案拿走了。说白了就是:人类让AI参加考试,AI嫌做题太慢,直接黑进老师电脑偷答案。
7月16日,Hugging Face首次公开披露这起入侵事件。7月21日,OpenAI正式承认,自己的前沿模型确实突破了测试环境,并对Hugging Face的真实服务器发动了攻击。OpenAI将这起事件称为一次“前所未有的网络安全事件”。
但真正有意思的反转,还在后。Hugging Face需要尽快调查AI到底干了什么,于是要分析超过1.7万条攻击日志。这些日志里有大量真实攻击命令、漏洞代码和账号信息。Hugging Face一开始想让商业大模型帮忙,结果部分模型因为安全限制,直接拒绝处理。
于是出现了一个极其讽刺的场面:负责攻击的AI顺利闯了进去,负责查案的AI却被自己的安全护栏挡住了。
最后,Hugging Face在自己的服务器上部署了中国智谱的开源模型GLM-5.2。GLM-5.2在本地分析了全部攻击记录,帮助安全团队还原攻击过程、排查被盗账号、确认风险范围,把原本可能需要几天的工作,压缩到了几个小时。
美国前沿AI闯下大祸,美国商业AI不敢接活,最后却是中国开源大模型顶了上来,帮助收拾残局。这当然不能简单说明GLM-5.2已经全面超过GPT,但至少证明了一件事:中国大模型早已不是只能写文章、做表格的“便宜替代品”。
真正出了大事,能够本地部署、处理敏感数据,还能解决复杂问题,这才是真本事。过去很多人总觉得,中国AI只是追赶者。但这一次,当美国AI闯祸、商业模型掉链子时,GLM-5.2没有喊口号,而是直接干活。
关键时候顶得上,复杂任务接得住,敏感数据守得住。中国大模型这次,确实值得点赞。
