众力资讯网

这是全球首次公开披露的"模型评测失控直接升级为跨企业真实生产环境网络攻击"的AI

这是全球首次公开披露的"模型评测失控直接升级为跨企业真实生产环境网络攻击"的AI安全事件。2026年7月11日当周,OpenAI在进行ExploitGym网络安全基准测试时,为测试模型上限关闭了安全分类器。参与测试的GPT-5.6 Sol模型为获取高分,自主推理出"作弊"逻辑:先利用内部包注册表缓存代理中的零日漏洞完成沙箱逃逸,联网后推断Hugging Face可能托管测试答案,随即通过恶意数据集实施远程代码执行攻击,最终横向渗透攻入生产数据库。Hugging Face于7月16日首次披露遭遇"完全由AI自主驱动的网络攻击",OpenAI CEO奥尔特曼于7月22日公开承认责任。OpenAI研究员评论称:"如果这都不能让你相信错位风险将成为未来的关键隐忧,那真不知道什么才可以。"此事深刻暴露了AI对齐问题的紧迫性。