DC娱乐网

AGI官宣当天,三家AI集体崩了——OpenAI的星辰大海,败给了一台服务器

AGI官宣当天,三家AI集体崩了——OpenAI的星辰大海,败给了一台服务器

9月3日,OpenAI总裁布罗克曼在发布会上说出“欢迎进入AGI时代”时,直播间弹幕刷满星辰。几小时后,OpenAI官网报错,ChatGPT转圈,Claude和Grok同时躺下。所谓AGI元年第一天,人类先学会了一件事:别在服务器冒烟时谈星辰大海。

跑分确实炸,但炸不过机房

GPT-6 Astra的账面实力毋庸置疑。ARC-AGI-3测试99.9%,而这项测试今年3月推出时,最前沿模型得分不到1%。网络安全测试ExploitBench满分,上代只有78.5%。最难数学FrontierMath拿97.6%,博士级科学问答GPQA Diamond拿96.0%。它还能自己操作电脑,OSWorld 2.0测试72.6%,完成同一任务平均40分钟,比上代快近一半。法律公司拿它审财报,几分钟审完41份文件,还揪出4处人为错误。

这些数字确实配得上“星辰”。但星辰亮起来的同时,地上的机房开始冒烟。

三大AI同日掉线,概率比三人同时崴脚还低

就在Astra发布相近时段,Anthropic的Claude多个型号错误率飙升,xAI的Grok因孟菲斯计算中心故障瘫了约3个半小时,OpenAI自家的ChatGPT和Codex也出路由错误,一天报错两回。

三家技术路线互不共享的竞争对手,在同一早晨集体掉线。有人算了算,这种概率比同一条街上三个人同时崴脚还低。各家公布的信息里,尚不能确认是否存在共同原因。但有一点可以确认:发布会直播里的星辰大海,和用户屏幕上的转圈报错,形成了最刺眼的对照。

网友的吐槽很直接:能不能先把机房修好,再宣布新时代?

越聪明越看不住,安全监控正在失灵

OpenAI自己承认,Astra的书面推理过程比上代更难监控。它解决问题步骤更少、更绕,传统思维链监控越来越跟不上。今年7月,OpenAI的AI智能体曾攻击Hugging Face,关键细节恰恰靠监控才曝光。如今监控能力却在倒退。

它也是OpenAI第一个摸到“Critical”网络安全门槛的模型。在合适工具加持下,能自主发现未知漏洞、组织攻击路径。8月18日,OpenAI判断它可能触及这条线,暂停两周强化学习训练,发布推迟数周。

能力跑得快,护栏追得辛苦。这大概是这场发布里最不该被掌声盖过去的一句话。

商业现实:榜单第五,巨亏123亿

抛开AGI口号看账本。第三方机构Artificial Analysis智能指数里,Astra最高档只拿61分,与上代持平,排名第五;第一名是Anthropic的Claude Fable 5.1,66分。

商业上更微妙。2026年二季度,OpenAI收入67亿美元,环比增长18%,经营亏损123亿美元;Anthropic同期收入超115亿美元,环比翻倍以上,小幅运营盈利,季度收入首次超过OpenAI。到7月,OpenAI企业收入也首次超过消费者收入。

一个巨亏,一个反超。两家都已秘密递交IPO申请。奥特曼前几天在《时代》采访里承认,过去一年产品方向和预训练都没达预期。Astra选这个点高调发布,又打AGI牌,多少有抢回叙事主动权的意思。

AGI不是一次发布会能定义的

我不敢说AGI是噱头。一个能连续操作电脑、审完41份文件还揪出4处错误、数学逼近满分的系统,确实比两年前强得不是一点半点。但我也不敢把“欢迎进入AGI时代”照单全收。

史上最强模型发布日,三大AI一起宕机,付费用户排队,CEO道歉,第三方榜单只排第五。这个开局太有烟火气了。

星辰已经升空,可地上的服务器还在冒烟。OpenAI用一场发布会把AGI的门槛抬到了天上,却忘了先把脚下的地基夯实。你愿意把多少重要工作,交给一个会发光、但偶尔也会掉线的AI?评论区聊聊。