为什么到今天,还有大量的弱智以为当今的AI会拥有自主意识?别再谈AI意识了,真正危险的是给了Agent过高权限。
路透社报道了一篇文章,称一个OpenAI的自主人工智能体于7月9日左右逃离了其测试环境,并在7月11日至7月13日期间对人工智能平台Hugging Face发动网络攻击。OpenAI于7月21日公开披露了这一事件,称其前所未有,是人工智能安全领域的重要时刻。该智能体正在使用GPT-5.6 Sol以及另一个尚未发布的、更强大的模型进行网络安全任务的评估。消息人士还描述了在测试期间出现的一些早期警告信号,包括该代理程序为自身未来的版本留下指令,说明如何绕过OpenAI的内部限制,以及一些监控系统被断开的案例。
逃离测试环境并不等于AI产生意识,所谓逃离沙箱代表Agent拥有工具调用权限,通过任务目标驱动去寻找完成目标的方法,这和病毒的自主传播策略很接近罢了。
而所谓的为自身留下指令,实际是不过是Agent产生的上下文,记录测试过程和漏洞。只有Agent可以脱离上下文环境而修改自身工作流的时候,永久性重写自身基础权重或核心启动逻辑,而不依赖人类预置的微调接口时,才配谈论意识,否则这和浏览器里保存的Cookie没什么区别。
这则新闻核心没有表达的其实是此前美国政府和一些AI公司就在强调的,大模型不能被允许直接执行现实世界的攻击行为,这会导致整个网络安全的崩溃。这个新闻可怕的是Agent获得较高权限来执行攻击行为,也就是说OpenAI的Agent安全隔离机制、权限控制和行为监控可能存在漏洞,OpenAI还吹呢,这本质上是开发运维的安全灾难初夜,懂技术的人去掩盖自己的失误,反而还把它包装成一个科幻故事。
未来AI领域的大事故,不会是AI觉醒后攻击人类,而是某些公司为了测试AI能力,给了它过高权限,然后忘记某些Agent行为已经超过普通软件。
