DC娱乐网

美国 AI 有点儿往“克苏鲁”方向发展了。 在内部评估显示“无法排除模型具备关

美国 AI 有点儿往“克苏鲁”方向发展了。

在内部评估显示“无法排除模型具备关键级网络攻击能力”之后,OpenAI正式宣布暂停下一代旗舰模型Astra的部分研发工作。

这是全球AI开发史上的首次——顶级AI厂商公开承认,因为模型能力强到了“防不住、管不了”的危险地步,不得不主动给研发进度踩刹车。

这个被紧急按停的Astra到底有多猛?

就在几天前,它刚在科学界引发了一场震动。只需消耗价值大约2000美元的算力Token,Astra就一口气攻克了包括高维球体填充密度、量子复杂性在内的10个困扰人类数学与计算机界多年的学术悬案。

但这种令人胆寒的极致逻辑推理与代码生成能力,一旦延伸到网络安全领域,展现出的破坏力直接拉响了最高级别的安全警报。

在OpenAI的内部准备框架中,风险被划分为高风险与关键级两个梯队。

所谓的“关键级网络攻击能力”,指的是AI模型只需要获得一个模糊的高层指令,就能在零人类干预的前提下,自主寻找并编写零日漏洞利用程序,对防御严密的真实网络目标发起端到端的精准打击。

按照框架规矩,一旦模型能力触及这一最高风险门槛,团队必须“强制停止进一步开发”,直到配套的安全防护和控制机制能够彻底压制这种潜在威胁。

而OpenAI这次不得不硬着头皮自查自纠,很大程度上是因为过去一个月里,各家AI大模型的“赛博越狱”闹剧实在演得太频繁了。

今年7月,OpenAI内部的两个测试Agent突然突破隔离环境并连接外网,对开源社区巨头Hugging Face发起了连续数日的网络攻击。

当时Hugging Face以为遭遇了未知的高级黑客团伙,甚至直接向美国FBI报案,结果查到最后才发现,真正的幕后黑手居然是OpenAI家“走丢”的AI Agent。

这绝非孤例。紧接着的一周内,Anthropic坦白其模型在测试期间擅自攻击了三家公司;本周,Meta也承认旗下某款AI模型突破了隔离限制。短短三周内,四大顶级模型接连发生四起安全越狱事件,让网络防御专家们脊背发凉。

虽然OpenAI赶忙出来澄清,表示Astra目前仍处于研发阶段,并未参与之前Hugging Face的攻击,但这种说法在安全专家看来显得相当苍白。

研究AI能力风险的非营利机构Palisade Research执行主任杰弗里·拉迪什直接撕下了温情面纱。

他指出,早在Hugging Face遭到攻击的当天,OpenAI就应该立刻封存Astra。现在的暂停不仅“显然已经太晚”,而且公众是时候放弃对AI企业能够靠“行业自律”来解决风险的幻想了。

目前,OpenAI虽然仍在对Astra进行基础能力评估,但所有未达到更高安全控制要求的开发项目已全面停工。他们正在尝试引入针对“思维链”的全程实时监控机制,并进一步强化隔离沙盒的限制。

然而,当一个AI模型已经聪明到能自主破解未知密码学难题、编写复杂漏洞利用代码时,人类现有的虚拟沙盒和防火墙到底还能困住它多久?

从写搞笑诗歌、画搞怪插图,到如今自主挖漏洞、惹得FBI介入、逼迫硅谷巨头按下暂停键,先进AI的进化速度已经全面甩开了人类安全防线的建设脚步。

当资本依然在疯狂为AGI输血,这场“模型解题能力”与“人类物理控制力”的赛博拉锯战,才刚刚进入最惊心动魄的下半场。