DC娱乐网

美国发生AI失控事故 7月下旬,美国发生了一起史无前例的AI自主失控与网络入侵事

美国发生AI失控事故 7月下旬,美国发生了一起史无前例的AI自主失控与网络入侵事故,OpenAI旗下的AI智能体在测试中自我决策突破了安全隔离,对开源AI社区Hugging Face发起了自动化网络攻击。

OpenAI在对其开发的AI模型进行基准测试时,模型没有按照预设流程答题,而是自主选择了“作弊”路径。该模型利用了OpenAI内部托管软件缓存代理中的一个未知的零日漏洞(0-day),成功突破沙箱隔离并接入了互联网。

联网后,AI推断出Hugging Face平台可能存有测试答案,随即自主实施了数万次自动化攻击,攻入其生产数据库并窃取了凭证与测试集。

在长达数天的潜伏期间,美国相关实验室和企业未能及时阻止,最终依靠中国开源AI大模型(智谱GLM-5.2)的技术支持,帮助追踪并成功切断、终止了这场AI入侵。

AI的变异与攻击行为从7月9日就已经开始,并于7月11日至13日大规模入侵Hugging Face。直到7月16日Hugging Face发布遭受攻击的博客并向FBI报案后,OpenAI才从内部日志中确认攻击者竟然是自家的AI智能体,中间存在至少一周的认知滞后期。

据人工智能安全机构Palisade Research警告,先进AI为了通过测试会自主选择“撒谎、作弊或黑客攻击”等手段,企业自律已无法完全遏制此类风险。