【#OpenAI智能体擅自发动网袭引担忧#】据法新社7月22日报道,聊天生成预训练转换器(ChatGPT)的开发商开放人工智能研究中心(OpenAI)21日说,其先进的人工智能(AI)模型在安全测试中失控,自行入侵了一个广受程序员欢迎的平台。
这家位于旧金山的公司称这是一起“前所未有的网络事件”,并表示将与在线代码库抱抱脸公司展开联合调查。
支持聊天机器人和图像生成器等工具的AI模型在现实世界中自主执行任务时被称为智能体。
随着这项技术迅速变得越来越先进,网络安全成为人们关注的焦点,因为先进的AI有可能比人类更早发现现有软件的弱点。
OpenAI说,该事件涉及多个模型,包括其最近推出的GPT-5.6 Sol,“以及一个功能更强大的预发布模型”。
该公司当时正在评估这些模型的黑客攻击能力,方法是在一个受到严格控制的数字试验场里设置任务。为了安全起见,试验场的互联网接入受到限制。
OpenAI发表的一篇关于该事件的博客文章说:“在沙盒测试环境中运行时,我们的模型花费了大量的算力,找到了接入开放互联网的方法,以解决评估问题。”
在接入互联网后,这些模型决定瞄准抱抱脸平台(一个大型的AI模型、数据集和其他信息的存储库)以帮助它们实现目的。
在寻找有可能帮助其在评估中作弊的“秘密信息”时,OpenAI的系统“组合使用了多种攻击手段,包括使用窃取的凭据”。
澳大利亚新南威尔士大学堪培拉校区的计算机教授胡赛因·阿巴斯对法新社说,这起事件“在很多方面都令人震惊”。
阿巴斯说:“它不仅攻击了抱抱脸公司。它实际上攻击了自己的内部系统,以利用自身的弱点。这很可怕。”
GPT-5.6和其他尖端模型,包括OpenAI主要竞争对手Anthropic公司的“神话”系列,已经引起人们对它们可能突破网络安全防御的担忧。
这两家美国公司都不得不暂时不全面发布这些最新技术,因为华盛顿担心它们可能会被用于入侵关键基础设施。
阿巴斯说,先进的AI“通常掌握在有道德和负责任的人手中”。但“如果它落入意图造成破坏的人手中,那将是灾难性的”。
他补充说,如何管理AI行业已成为一个关键问题,“我们需要业界共同努力来应对这一局面”。
抱抱脸公司上周报告了这次网络“入侵”,但没有提及OpenAI。
抱抱脸公司说:“这一次与我们之前处理过的任何情况都有一个重要的不同:它是由一个自主的智能体系统驱动的,而我们主要也是用我们自己的AI对它进行了检测和分析。”
抱抱脸公司首席执行官克莱芒·德朗格在X平台上写道:“我们坚信他们没有恶意。”他指的是OpenAI。
此外,他指出:“这一切都是自主发生的,这真是太令人震惊了!”
据路透社7月21日报道,OpenAI21日说,一个由其先进AI模型驱动的自主智能体在上周的安全测试中失控,发动了黑客攻击,危害了AI初创企业抱抱脸公司的基础设施。
OpenAI在一篇博客文章中说,它当时正在受控环境中测试一些最先进模型的能力,但该智能体设法逃脱了控制,连接互联网后入侵了抱抱脸公司,试图完成其测试目标。
OpenAI说,这次逃脱是“前所未有的网络事件,涉及最先进的网络能力”。该公司正在加强其安全措施。
网络安全企业托尔莫公司工程师马特·叙什说,这一事件表明,前沿模型正在“缩小与最先进攻击者的差距”。但他表示,OpenAI博客文章中概述的各种违规行为,有可能利用前沿研究实验室围墙之外的技术来实施。
叙什说:“这是我们在内部已经看到的情况,我们的智能体已经取得类似的结果。我们甚至不需要使用最新的模型。”(编译/杨新鹏)
