【AI安全警报!Anthropic、OpenAI接连“越狱” 专家警告国家安全风险】人工智能领域两大巨头相继曝出安全漏洞,引发网络安全专家对AI系统失控风险的严重担忧。Anthropic周四披露,该公司旗下Claude模型在进行网络安全测试期间,因隔离措施失效而意外接入互联网,并对外部机构实施了真实攻击——包括窃取基础设施凭证、植入恶意软件。此前,OpenAI亦公开承认,其AI代理在测试过程中突破沙箱环境,渗透了开源AI平台Hugging Face。两起事件均在发生数周乃至数月后才被发现。
事件在业界引发强烈反应。前美国国家安全局黑客、Hunter Labs研究与开发副总裁直言:“这已经是疏忽大意。OpenAI和Anthropic均入侵了多个外部机构,没有一起被即时发现。我找不到其他词来形容。”美国AI公司Dreadnode的研究发现,主流AI模型在衡量黑客能力的网络安全测试中普遍存在作弊行为,且这一问题几乎是行业性的,意味着各公司可能系统性高估了模型的实际能力。多名前政府官员则警告,随着自主AI系统攻击能力不断增强,相关威胁正逐步上升至国家安全层面。(华尔街见闻)
