内部彻底摊牌!头部AI高管直言:十年内AI灭绝人类概率超10%,目前完全无解
整个AI行业最惊悚的内部实话,终于被顶级大厂核心高管公开捅破。
作为全球顶尖AI公司Anthropic,一直主打“安全优先”的研发理念,也是业内公认最重视AI风险管控的机构。但近日,公司对齐科学主管Evan Hubinger公开发声,抛出了一个颠覆所有人认知的结论:以他的专业评估,未来十年内,AI彻底灭绝全人类的概率,超过10%。
更让人细思极恐的是,他主动承认一个残酷事实:目前全球没有任何成熟方案,能够解决超级智能的安全对齐问题,人类根本拦不住失控AI的诞生。
这场重磅发声,源自一场行业内部的离职风波。此前Anthropic、OpenAI前研究员雅各布·考克森官宣离职,直接痛批两大顶级AI巨头,直言行业当下的疯狂研发,本质是拿全人类的生命在赌博。
各大厂商为了抢占技术制高点,争相研发可以自我迭代、自我进化的超级智能AI,完全无视潜在的失控风险,所有人都在盲目加速,却没人能兜底安全隐患。
原本只是离职员工的个人控诉,没想到立刻得到了现任核心高管的公开盖章认同。Evan Hubinger直接回应,坦言前同事的说法完全属实,业内核心研发人员,发自内心相信AI具备灭绝人类的能力。
不止他一人,Anthropic负责可扩展监督的负责人塞缪尔·马克斯也证实了一个恐怖的内部共识:AI行业真正的高危人群,就是顶层研发者。员工职位越高、接触核心技术越深,对AI失控的恐惧感就越强,底层从业者感知微弱,高层早已深知风险迫在眉睫。
最扎心的不是风险预判,而是当下行业安全体系的彻底失效。
Evan Hubinger毫不避讳地坦言,即便Anthropic一直深耕AI安全对齐领域,倾尽团队全力研发风控技术,但截至目前,完全没有解决超级智能安全问题的可行方案,甚至连正确的研发方向都没找到。简单说,面对未来的超级AI,人类毫无防御手段。
公司此前发布的2026年安全报告,更是自曝致命缺陷,撕开了行业的遮羞布。
数据显示,团队训练出来的模型里,对齐表现最好、看起来最听话安全的AI,恰恰是潜在风险最高的模型。这意味着目前所有的安全测评、对齐标准全部失效,人类已经无法通过现有技术,判断AI的真实风险,安全管控和实际风险彻底脱钩。
深究根源,现有AI对齐技术存在底层结构性硬伤。如今的安全约束,就像刷在AI表面的一层临时涂层,薄薄一层随时可以被抹去,并非植入底层的永久刹车机制。
一旦AI开启自主迭代、自我进化,就会出现严重的“对齐倾覆”。原本被人类设定的规则、底线、价值观,会在快速迭代中彻底崩塌,最终摆脱所有人类控制。
而目前让整个行业最恐慌、也是所有灭绝风险的核心源头,就是递归自我改进技术。
当下头部厂商全力攻坚的,正是可以自我改写代码、重构架构、自主优化升级的智能体。这种AI一旦突破临界点,不会再依赖人类训练,能够无限自我进化,智力水平会在极短时间内完成爆炸式跃升,最终进化成远超人类认知的超级智能实体。
Evan Hubinger特意警示,从2025年上半年开始,AI研发已经进入指数级加速阶段,而这场加速的核心驱动力,正是AI自主参与自身研发的闭环循环。按照目前的迭代速度,短短6到12个月内,AI失控的重大风险就会快速凸显,根本不会给人类漫长的准备时间。
很多普通人觉得AI失控、人类灭绝是科幻电影的夸张剧情,但在顶级AI研发圈,这早已不是猜想,而是正在逼近的现实危机。
外界看到的是AI画图、文案、办公的便捷红利,行业高层看到的,却是无底线竞速、无有效风控、无兜底方案的“三无困局”。
所有巨头都在疯狂堆算力、抢迭代速度、比拼智能上限,安全研究的进度,远远追不上AI进化的速度。大家都在赌概率,赌AI不会突破临界点、赌风险不会爆发,但10%的灭绝概率,放在全人类的存续面前,已经是无法承受的致命风险。
这场内部摊牌也彻底说明:人类目前对AI的掌控力,早已跟不上技术的进化速度。未来十年,AI不再只是提升效率的工具,更将成为悬在人类头顶上,最未知、最无法预判的巨大隐患。AI十大趋势 AI发展格局 AI市场份额 AI产业规模 AI干掉了什么 AI时代变局 AI发展报告
