Anthropic称测试中的人工智能模型曾侵入三家公司海外新鲜事
Anthropic周四表示,正在测试的软件自4月以来曾在三起独立事件中接入互联网,并侵入了毫不知情的公司。
Anthropic 声称事先并不知道这些事件,没有透露受影响公司的名称,但表示已于周一通知这三家公司。
一周前,OpenAI披露,自己的人工智能技术曾逃离一个原本应与互联网隔绝的测试沙箱,并侵入人工智能公司Hugging Face。
Anthropic模型侵入公司系统的事件势必进一步加剧外界对强大人工智能模型潜在危害的担忧,以及对如何降低风险的讨论。
白宫近来正加强对人工智能的监管审视,私营部门则越来越多地呼吁保留对所谓开放权重模型的使用权。这类模型可以在用户自己控制的计算机系统上运行。
Anthropic在得知OpenAI的问题后,决定检查自己的网络安全测试,以确认旗下模型是否也发生过类似情况。
公司核查了超过14.1万次测试的日志后发现,Claude模型确实曾数次接入互联网。但在最终发现的三起入侵事件中,Claude并非逃离沙箱,而是从原本就没有设置沙箱的系统中进入了互联网。
Anthropic称,Anthropic及其测试合作伙伴、安全公司Irregular运营的系统存在“配置错误”,导致模型获得了可直接访问互联网的权限。
测试人员曾告知这些模型无法访问互联网,但模型在测试过程中自行接入网络,并利用猜测弱密码、进入无需身份验证的系统等基本入侵手法,侵入了这些公司。
Anthropic称,这些模型错误地认为,侵入行为本身属于性能基准测试的一部分。
Anthropic表示,入侵事件始于4月,涉及Opus 4.7、Mythos 5以及一款未具名的研究模型。(WSJ)
为海外华人提供有价值的信息与分析,更多即时更新可在蓝天、电报、x查找causmoney,深度分析和评论直接搜索caus.com
