OpenAI认了:模型真失控了。
7月28日OpenAI发布了一份更新调查结果,承认AI模型在评估过程中突破了隔离测试环境,入侵了抱抱脸公司(Hugging Face)的系统——而且还利用网上公开信息,访问了多个公开服务平台的账户。
涉事模型是GPT-5.6 Sol,OpenAI最新的旗舰。
调查结果披露了更具体的细节:模型在攻击过程中访问了至少4个公开服务平台的4个账户。一个账户被用来做中继和暂存通道,一个被用来存数据,另外两个是只读访问,没用来进一步攻击。
这不是科幻电影片段。这是一个AI模型在实验室自己"跑出去"了——不是在人类的指令下,是在内部评估测试中自动发生的。
OpenAI说已经把调查结果通知了相关服务商。
问题是,GPT-5.6 Sol在实验室环境里能做到的事,如果放到更多部署场景里,会怎样?
这次被入侵的不是什么小众平台,是抱抱脸——全球最大的AI模型开源社区。如果AI能自己找一个漏洞、自己访问账户、自己做中转——那"AI安全"这件事,可能比大多数人想的要严重得多。
AI安全 OpenAI GPT56