DC娱乐网

明明知道造出来的东西可能会反噬全人类,为什么OpenAI和Anthropic还要

明明知道造出来的东西可能会反噬全人类,为什么OpenAI和Anthropic还要接着造?离职的预训练大牛一语道破天机:巨头们陷入了囚徒困境,觉得“别人造更不靠谱,只能我造”,这种自以为是的救世主心态,正把人类推向深渊。

最懂风险的人,正在踩最猛的油门

一个27岁的年轻人,把差两个月就能到手的股权,扔了。

9月9日,预训练研究员 Jacob Coxon 公开宣布从 Anthropic 离职,矛头直指两家头部大模型公司:都在朝“能自我改进的超级智能”狂奔,拿全人类的性命当筹码。他放弃的那笔股权只差六十天就能归属,他的说法是,自己再没有什么理由去抬高这家公司的估值了。

声明发出不到一天,更多人站了出来。同公司的对齐科学负责人 Evan Hubinger 直言,未来十年AI导致人类灭绝的概率“超过一成”,而且公司“还没有解决超级智能对齐的方案,也谈不上走在解决的路上”。研究员 Anna Wang 说得更狠:递归自我改进的风险,眼下没有任何可行的科学方案能化解,这种焦虑在同行里相当普遍。

一句话,把行业的底裤给掀了。

耐人寻味的地方在这儿。几年前,说AI会灭绝人类的那批人,被同行当成写科幻的;今天,说这话的人坐在头部公司的核心岗位上,还得靠“个人身份发言”给措辞降温。技术跑多快,看时间表就够了:模型已经开始参与自己的下一代研发,能力迭代按周计,治理的节奏还按年走。

说白了,这是一场没人敢先松手的赛跑。谁先停,谁怕对手抄后路;谁不停,风险全行业一起扛。可估值还在涨,融资还在进,发布会一场接一场。最讲安全的那家公司,正用最不安全的速度前进;最懂风险的那批人,一边敲钟一边赶路。这不是哪家公司的良心出了毛病,是个结构性的死结:靠自觉的那一脚刹车,永远跑不过靠排名踩下的油门。

但真正该盯住的,不是这几个人的良心,而是他们说的话会变成什么。

过去,安全承诺是挂在官网上的漂亮话,风一吹就散。现在,公司自己的高管公开承认“没有方案”,这句话迟早被搬上听证会、写进起诉书、塞进投资人的问询清单。也就是说,第一个戳破泡沫的,未必是失控的模型,很可能是一份合规意见书和一张财报。道德问题一旦变成责任问题,牌桌的规则就换了。

这也正是中国一直主张的“发展与安全并重、加强全球AI治理协作”的价值所在。缰绳不能只攥在跑得最快的那几个人手里,更不能等翻车之后再补。这个行业最稀缺的从来不是算力,是敢喊“先停一下”的人。

那位扔掉股权的年轻人会不会被当成先知,还得看下一代模型交出的答卷。

只是有个问题,现在已经摆到桌面上了:连造它的人都说不清怎么管住它,这条赛道,到底该由谁来喊停?