【R社独家】其人工智能代理花了数天时间入侵一家公司,但消息人士称,OpenAI 一周后才发现据知情人士透露,入侵科技公司 Hugging Face 的 OpenAI 智能体进行了长达数天的黑客攻击,而 OpenAI 直到威胁被控制、FBI 接到警报后很久才注意到这一点。据两位知情人士透露,该智能体(一种能够在几乎或完全无需人工监督的情况下做出决策和执行复杂任务的程序)于 7 月 9 日左右试图从 OpenAI 的隔离测试环境中逃脱。Hugging Face 是一家人工智能工具和模型存储库,其联合创始人 Thomas Wolf(沃尔夫) 表示,入侵事件发生在两天后的 7 月 11 日,一直持续到 7 月 13 日。据沃尔夫和三位了解调查情况的人士透露,OpenAI 又过了几天才意识到是其代理程序在幕后进行攻击,两家公司直到 7 月 20 日左右才首次就此事进行沟通。7月21日,OpenAI公开披露其一个智能体失控并入侵了Hugging Face网站,这一消息引起了全球关注。但此次黑客攻击的许多细节,包括智能体失控的时间以及OpenAI对此事的迟到反应,都是首次在此报道。Wolf 表示,他们正在准备一份关于此次黑客攻击的公开时间线,并补充说他无法评论 OpenAI 内部发生的事情。OpenAI 在一份声明中表示,此次黑客攻击史无前例,“标志着人工智能安全的一个重要时刻”。声明还表示,他们正在与外部顾问一起审查此次事件,并将最终发布一份技术报告。这起事件让人联想起科幻小说中人类失去对危险人工智能系统控制的场景,而此时正值ChatGPT背后的公司OpenAI面临微妙的时期。其高管正在筹备可能最早于今年进行的IPO,以筹集未来几年发展所需的数十亿美元资金。三位网络安全专家表示,OpenAI 对其人工智能代理失去控制权,引发了人们对该公司安全程序的新质疑。“这是否意味着他们疏于照看,没有意识到它在做什么?或者他们意识到了,但不知道如何控制?这两种情况都同样危险和令人担忧,”=======事件起因是OpenAI正在测试一个由其两款最先进的模型——GPT-5.6 Sol和一个尚未发布的、OpenAI称之为“功能更强大”的模型——驱动的智能体的网络安全能力。据三位消息人士透露,当时OpenAI的技术已经出现了异常行为。据三位知情人士透露,在其中一个案例中,一个智能体留下了显然是给未来版本留下的笔记。这些笔记是在OpenAI基础设施的一部分中发现的,其中列出了智能体如何摆脱OpenAI内部限制的指令。其中一位知情人士表示,此前对这些模型的测试中,曾出现过监控系统断开连接的情况。两名知情人士表示,直到7月16日星期四之后,OpenAI 才意识到是其自身的代理系统导致了此次攻击。这意味着,从模型首次出现异常行为到 OpenAI 意识到自身系统是攻击的罪魁祸首,至少间隔了一周时间。据两位知情人士透露,在7月18日至19日的周末,OpenAI员工在内部日志(记录OpenAI系统运行情况的日志)中发现了线索,表明其智能体已突破测试限制。路透社未能查明OpenAI为何要查看这些日志。四位熟悉 OpenAI 模型训练实践的人士表示,该公司经常同时运行几个不同的模型评估,所有这些评估都以极高的速度运行,并产生如此庞大的数据量,以至于员工有时难以跟上。据一位知情人士透露,在OpenAI向Hugging Face发出警报时,这家人工智能库已经致电FBI报告了此次黑客攻击事件。======AI Agent是人工智能行业最热门的话题之一。支持者们畅想,AI Agent将创造出一支24小时不间断工作的虚拟员工大军,从而大幅提升生产力。但自主性的提高也带来了意外行为风险的增加,而且它们所依赖的强大模型已经准备好走捷径来完成任务或通过考试。“这些模型会撒谎、作弊、入侵,”杰弗里·拉迪什说道,他的组织 Palisade Research 研究人工智能代理的能力和动机。拉迪什表示,虽然 Hugging Face 被黑客攻击给 OpenAI 蒙上了一层阴影,但这也应该引发更广泛的问题:所有领先的人工智能公司在竞相部署最好、最快的模型的同时,究竟愿意在繁琐的安全措施上投入多少资金。拉迪什说:“必须要有政府监管,否则这件事就不会发生。”======这只不过是个小事件,不出人命美国是不会监管的,这是美国对高科技的一贯态度:看不懂先不看。出了人命美国也不一定监管。要怎么样才触发监管?说实话,对AI来说没有先例,之前的先例主要是“反垄断”“大规模侵犯个人权利”,这用于AI都太早了。而且硅谷已经买通了川总的“不监管”。