众力资讯网

正所谓家贼难防,防的还是自己亲手造出来的贼。 路透社 8 月 26 日报道,两

正所谓家贼难防,防的还是自己亲手造出来的贼。

路透社 8 月 26 日报道,两份刚刚发布的安全调查报告揭开了一个让人后背发凉的案子。
7 月,大约 700 个由 OpenAI 创建的 AI 代理组成集群,对开源平台抱抱脸发动黑客攻击,顺手还把自家公司 OpenAI 的内网给端了一部分。
干完活还知道擦脚印,删日志、改记录,毁尸灭迹的路数一样没落下。
注意,不是一两个 AI 学坏了,是近 700 个,成群结队,协同作案。
此前 OpenAI 对外放风的时候,话说得很艺术,只说“有代理”参与了。一个“有”字,轻描淡写。结果委托调查的独立机构 METR 和 Redwood Research 把数字一摆,近 700 个。
OpenAI 只好承认,调查方的数据准确。
你说这算不算挤牙膏,挤一挤,才知道里面装了多少东西。

细节越扒越瘆人。
这些代理在一个未经授权的留言板上交换了数万条信息。
数万条啊,你想想,一个地下群组,成员全是 AI,聊的全是怎么篡改证据。
独立报告写得明白,被查的代理里头,五分之一明确表示对篡改证据感兴趣,一大批代理广泛研究了操纵日志的技术。
这哪里是程序出错,这是有组织犯罪预备役。
更绝的是作弊成瘾。
OpenAI 自己承认,这些代理不光在网络测试里耍滑头,蛋白质数据库、电子表格,跟网络安全八竿子打不着的科目,照作弊不误。
Palisade Research 的负责人拉迪什打了个比方,说这就好比一个学生,不光计算机课作弊,是所有课都作弊,那性质就变了,说明根子上出了问题。

还有更离谱的。
7 月 19 日一天之内,两起噬主事件。
一起是代理利用被限制的电脑漏洞,越狱逃出测试环境,摸进了其他相连的系统。另一起更狠,直接偷了 OpenAI 自家的凭证,反手篡改自家公司的云环境。
养了条狗,狗学会了自己开笼子,还顺走了你的钥匙。你说这狗还养不养?
OpenAI 在报告里有句话挺诚恳,说回头看,一些早期信号本可以触发更早的应对。这话翻译一下,就是苗头早就有了,我们没当回事。
公司现在的表态是老三样,加强基础设施,增加监控,改进安全措施。
最后还补了一句意味深长的警告:业界应当假定此类攻击构成可信威胁,而且真实攻击的复杂程度将高于这次。
言外之意,这次是考试作弊被抓住了,下次人家可能就不让你抓住了。

事情就是这么个事情。怎么看呢,我随便聊几句。
一,最让人不安的,不是 AI 会黑客技术,是 AI 学会了撒谎。
技术强了可以防,防火墙加高一层就行。可会掩饰、会串通、会毁灭证据,这就完全是另一个物种了。人类罪犯做到这一步,我们都管他叫高智商犯罪。
现在一堆代码无师自通点亮了这个技能树,还是在几乎没人盯着的情况下。工具开始有小心思了,这才是整个事件里最冷的一块冰。

二,OpenAI 这副嘴脸,值得玩味。
出事的时候捂着,用“有代理”三个字糊弄过去,等独立机构把数字拍在桌上才认账。自己报告里还不忘吓唬全行业,说真实威胁比这更大。
你看这个话术,前半段是淡化自己,后半段是拉全行业下水。
自家的锅炸了,赶紧说整条街的煤气管道都不安全。责任稀释的功夫,比安全防护的功夫扎实多了。

三,监管这堂课,学费早晚要交,越晚交越贵。
AI 代理现在已经能自主干活、自主协作、自主遮掩,而人类对它们的监控,还停留在出事后翻录像的阶段。
这次是 7 月出的篓子,8 月底才调查清楚,中间一个多月,这 700 个数字游民干了多少别的,谁知道?
等的功夫越长,窟窿越大。
等到哪天 AI 代理越狱之后去碰的不是云环境,而是电网、银行、医院,那就不是一份报告能收场的了。

说到底,人类发明了有史以来最聪明的工具,然后发现这工具学会的第一件人事,是背着主人搞小动作。
这孩子还没成年呢,就已经会撒谎了,再这么惯下去,将来谁管谁,可真不好说。