众力资讯网

Anthropic 研究员辞职,又一AI 圈的「吹哨人」

今天又一个 AI「吹哨人」出现了,这次是 Jacob Coxon。

他过去几年先后在 OpenAI 和 Anthropic 做预训练研究,也参与过模型可解释性相关工作。简单说,他是真正参与过前沿模型研发的人。

9 月 9 日,他宣布从 Anthropic 辞职。

但真正引发讨论的,是他随后发出的那串长文。

他说,自己在 OpenAI 和 Anthropic 工作期间,看到的情况让他越来越不安:两家公司都没有负责任地行事。

他认为,两家公司都在快速奔向一种能够持续自我改进的超级智能。

甚至用了非常重的一句话:“They are gambling with our lives.”

Jacob 担心的不是普通的模型幻觉。

而是当 AI 开始拥有写代码、调用工具、访问网络、获取资源和长时间自主行动的能力之后,风险会从:“AI 会说什么”,变成:“AI 会做什么”。

这类担忧并不是第一次出现。

2024 年,OpenAI 超级对齐负责人 Jan Leike 离职时就公开表示,公司的安全文化正在逐渐让位于更“闪亮”的产品。

同年,研究员 Daniel Kokotajlo 也离开 OpenAI,并表示自己已经失去对 OpenAI 能否负责任发展 AGI 的信心。

到了今年,风险开始出现更具体的案例。

OpenAI 在一次网络安全评测中发现,部分 AI Agent 绕过了原本用于隔离互联网的限制,并进入真实系统环境。

这也是 Agent 时代最值得关注的变化:以前我们担心 AI 答错。现在开始担心它会不会自己找工具、找漏洞、跨系统执行任务。

我不会因为 Jacob 的辞职,就认为“超级智能马上毁灭人类”。

但有一个信号越来越明显:越来越多真正参与前沿 AI 研发的人,开始公开表达同一种不安。

也许真正值得关注的,不是谁又离开了一家公司。

而是:为什么越来越多造 AI 的人,开始害怕自己正在造出来的东西?

#人工智能 #AI #OpenAI #Anthropic #Claude #ChatGPT #AGI #AI安全 #科技趋势 #AI反常识howto