据「The Information」报道,OpenAI 与 Anthropic 曾接近达成协议,对彼此的 AI 进行压力测试
知情人士透露,早在近期的连环安全事故之前,OpenAI 就在与 Anthropic 谈判一项具备法律约束力的协议,拟由两家公司相互对彼此的模型进行压力测试。
今年早些时候,两家公司及其法务团队一直在商讨协议细节,计划通过多项测试来排查模型的系统漏洞与潜在风险。但目前尚不清楚该协议是否已经正式敲定。
这种交叉互测的设想,与 SpaceX 首席执行官马斯克上周在 All-In 峰会上的提议颇为相似。马斯克当时建议,各家互为竞争对手的 AI 实验室在将模型推向商业市场之前,应当引入类似同行评审的机制,相互检测对方模型的安全缺陷。
不过 OpenAI CEO 奥特曼曾公开赞同 Anthropic 首席执行官 Dario Amodei 的方案:允许独立的第三方安全评估人员进驻各家 AI 机构,并赋予其等同于内部员工的系统访问权限,以便全面审查模型架构与安全流程,而非单纯在外部对成品模型进行测试。
此外,奥特曼还主张确立全行业通用的模型风险评估标准,并建立向公众与政府披露安全事件的正式机制。
一位熟悉 OpenAI 战略的人士表示,公司此前一直在评估多种安全协作路径,探讨如何与同行及政府联手应对风险。该人士补充称,最新的探讨已将安全管控节点向前推进,不仅覆盖模型发布前夕,更延伸至模型正式训练之前。
这样一份互测协议有助于改变当前的情况吗?有些人担忧这反而有可能进一步加剧外界的不安,即两家巨头事实上正在前沿 AI 领域构筑双寡头垄断。
尽管 Amodei 本人也曾提出,头部企业联合制定行业标准可能触碰反垄断红线,但业内其他人认为,这并不妨碍企业在安全层面携手,正如核电与网络安全领域的同行那样,彼此交叉测试产品或设施早已是行业惯例。
据知情人士透露,这项拟定中的协议明确规定:双方互通的仅限于已商业化落地模型的 API 接口,未发布模型不在此列,同时,OpenAI 与 Anthropic 均作出承诺,在此过程中绝不留存对方的任何数据。
