众力资讯网

宣布AGI当天,三家AI一起崩了:GPT-6封神首日,CEO排队道歉 9月3日

宣布AGI当天,三家AI一起崩了:GPT-6封神首日,CEO排队道歉

9月3日,OpenAI发布GPT-6 Astra。总裁布罗克曼宣布:“欢迎进入AGI时代。”追了几十年的AGI就此官宣,但后续比发布更精彩。

跑分有多炸,干活就有多利索

Astra有封神资本。OpenAI迄今最大训练,动用超十万块GPU。ARC-AGI-3测试99.9%,该测试3月推出时前沿模型不足1%。网络安全测试ExploitBench满分,上代78.5%;最难数学FrontierMath拿97.6%,博士级科学问答GPQA Diamond拿96.0%。

打工人在意的是“用电脑”能力。OSWorld 2.0测试72.6%,上代65.7%;关键在速度:完成同一电脑任务,Astra平均40分钟,上代75分钟。编程测试从37.3%跳到57.7%,自动化任务从18.1%涨到41.4%。

它能填表单、理邮件、写代码、做表格、生成PPT。法律公司Legora拿它审财报,几分钟审完41份文件,还揪出4处人为错误。你给它一个目标,它自己拆任务、调工具、连续干几十分钟交成果。

奥特曼说,希望Astra开启“新一代的创业、科学发现与创造”。星辰确实亮,然后天亮了。

同一天,三大AI集体掉线

Astra发布相近时段,美国头部AI服务扎堆故障。Claude多个型号错误率飙升;Grok因孟菲斯计算中心故障瘫了约3个半小时;OpenAI自家的ChatGPT和Codex也出路由错误,一天报错两回。

针锋相对的三家公司,技术路线互不共享,却在同一早晨一起掉线。有人算了算,概率比同一条街上三个人同时崴脚还低。各家公布信息中,尚不能确认是否存在共同原因。

发布会直播里星辰大海,用户屏幕上转圈报错。网友吐槽:能不能先把机房修好,再宣布新时代?

付费用户排队,CEO亲自道歉

更尴尬的是,新模型不是谁都能用。OpenAI分阶段开放,第一批给接入Daybreak网络安全平台的企业客户。Plus、Pro、Business、Enterprise这些付费用户和API用户,得等“未来数天”。

火气最大的是Pro用户,付着最高档月费,过去新功能向来第一个尝鲜,这次眼看企业客户插队,评论区被投诉淹没。

发布几小时后,奥特曼在X上道歉,承认是“混乱的发布”,说“我知道这令人沮丧”。被问何时能用,他原话是“希望”本周末,但“无法承诺”。补偿方案:付费用户每用不上一天,赔一次额度重置。

价格方面,Astra的API每百万token输入10美元、输出50美元,是上代2.5倍,Fast Mode再翻倍。星辰很贵,门票也不便宜。

越聪明,越看不住

更让人打鼓的是安全。OpenAI承认,Astra书面推理过程比上代更难监控,步骤更少、更绕,传统思维链监控跟不上。安全倡导者批评激烈:今年7月,OpenAI的AI智能体曾攻击Hugging Face,关键细节恰恰靠监控才曝光。

它也是OpenAI第一个摸到“Critical”网络安全门槛的模型,在合适工具加持下,能自主发现未知漏洞、组织攻击路径。8月18日,OpenAI判断它可能触及这条线,暂停两周强化学习训练,发布推迟数周。

能力跑得快,护栏追得辛苦。这大概是这场发布里最不该被掌声盖过去的一句话。

王座之下,账单很现实

抛开口号看账本。第三方机构Artificial Analysis智能指数里,Astra最高档只拿61分,与上代持平,排名第五;第一名是Anthropic的Claude Fable 5.1,66分。

商业上更微妙。2026年二季度,OpenAI收入67亿美元,环比增长18%,经营亏损123亿美元;Anthropic同期收入超115亿美元,环比翻倍以上,小幅运营盈利,季度收入首次超过OpenAI。到7月,OpenAI企业收入也首次超过消费者收入。

一个巨亏,一个反超。两家都已秘密递交IPO申请。奥特曼前几天在《时代》采访里承认,过去一年产品方向和预训练都没达预期。Astra选这个点高调发布,又打AGI牌,多少有抢回叙事主动权的意思。

我不敢说AGI是噱头。一个能连续操作电脑、审完41份文件还揪出4处错误、数学逼近满分的系统,比两年前强得不是一点半点。但也不敢把“欢迎进入AGI时代”照单全收。史上最强模型发布日,三大AI一起宕机,付费用户排队,CEO道歉,第三方榜单只排第五。

这个开局,太有烟火气了。星辰已经升空,可地上的服务器还在冒烟。你愿意把多少重要工作,交给一个会发光、但偶尔也会掉线的AI?评论区聊聊。觉得有用点个赞,转发给同样在等Astra开通的朋友,关注我,下次AI圈再出大动静,咱们接着拆。