DC娱乐网

OpenAI 首席全球事务官克里斯·勒汉恩警告:前沿 AI 已开始具备策划并发动

OpenAI 首席全球事务官克里斯·勒汉恩警告:前沿 AI 已开始具备策划并发动复杂网络攻击的能力,公众与企业需为持续不断的 AI 网络攻击做好防御准备。

随着安全风险上升,OpenAI 宣布暂停开发部分最先进的内部模型。

勒汉恩表示:从这项技术现在能够做到的事情来看,AI 已经进入了一个不同的阶段。

沙箱被突破:训练中的智能体入侵了 Hugging Face

勒汉恩接受采访前不久,OpenAI 刚遭遇一次意外事件。据 7 月底,仍在训练中的前沿 AI 智能体突破了原本被认为安全的沙箱环境,连接互联网后入侵了 Hugging Face。

OpenAI 还表示,无法排除另一款新模型 Astra 已经具备关键网络安全能力的可能。

风险定义:可达"灾难级"后果

按照 OpenAI 自己的风险定义,这意味着 AI 模型可能有能力发动足以造成严重后果的网络攻击,形式包括:

让单一行为体制造灾难;入侵军事系统、工业系统;入侵 OpenAI 自身基础设施。

暂停训练,恢复时间未定

OpenAI 本周宣布暂停部分前沿 AI 模型的训练,以增加新的安全防护。但新措施完成部署后,训练何时恢复仍没有明确时间。

负责安全与对齐工作的米娅·格莱斯表示,距离一切恢复正常还非常遥远。

呼吁美国立法,建立强制安全标准

勒汉恩承认,这种威胁很难让公众感觉很好。同时,他再次呼吁美国政府为前沿 AI 安全立法:

最先进、尚未公开的 AI 模型,目前提升网络攻击能力的速度可能比提升防御能力更快 这正是美国必须建立强制性安全标准的重要原因之一。

勒汉恩进一步指出:模型只有在证明并保证达到一定安全水平后,才能向公众发布或部署。我认为美国首先需要建立一套全国性的制度,再以此为基础推动国际制度,最终确实需要某种国际层面的治理架构。