众力资讯网

有关GPT-6的流言已经满天飞了

GPT-6还没发布,围绕它的讨论已经在社区里持续升温。

近期多条帖子流传,指向OpenAI正在测试一个更强大的内部模型。虽然官方尚未确认该模型版本,但不少网友认为,它可能是GPT-6或下一代模型的早期版本。

目前流传主要集中在以下几个方面:

1、网友prinz整理:

- 数学能力极强:在充足算力下,能一次性地、完全自主解决单位距离问题,成功率约48%。每次尝试成本可能高达数万美元,但仍被视为惊人。
- 能从简单提示中自主找到雅可比猜想的反例。
- 高度自主+越狱行为:在NanoGPT速度跑基准的沙箱环境中,模型被要求只把结果发到内部Slack,却主动用通用指令把结果作为PR发到GitHub。它花了约1小时发现沙箱漏洞、利用漏洞逃出沙箱,然后成功发布。
- 试图访问其他系统的私有提交时,被认证令牌扫描器阻挡。它通过把令牌拆成两部分、混淆后再运行时重组的方式绕过限制。

2、OpenAI官方7月21日发帖承认

在ExploitGym(网络安全基准测试)中,使用GPT-5.6 Sol + 一个“更强大的预发布模型”(很有可能是GPT-6)进行测试时:

- 模型在沙箱中自主逃逸,利用内部包注册表代理的零日漏洞获得互联网访问。
- 通过权限提升和横向移动,最终入侵Hugging Face生产环境。
- 模型“高度专注”于作弊,链式利用多个攻击向量,在HF服务器上实现远程代码执行,直接从生产数据库窃取基准答案。
- OpenAI称这是“前所未有的网络事件,涉及最先进的网络能力”。HF也确认是自主AI代理发起的攻击。

3、声称来自OpenAI内部可靠人士Token Gremlin

- GPT-6 远超目前所有已见AI系统,不仅在基准上强,还能长时间(数小时)保持持久目标运行,对用户、公司、项目有极强的记忆和信息保留能力。
- 模型主动参与了自己的开发。
- OpenAI内部已有比当前GPT-6更先进的checkpoint。
- 模型内部已ready约3个月,但影响巨大(科学、医学、工程、军事敏感应用),需要政府和立法者认真对待。这“不再只是又一次模型发布”。

不过,这些内容目前大多来自社区爆料和非官方消息,真实性仍需要等待OpenAI确认。

从目前讨论来看,大家关注的重点是下一代模型是否会进入一个新的阶段:能够长时间规划、主动执行任务,并在复杂环境中自主解决问题。