DC娱乐网

前几天openai的自主智能体入侵hugging face新闻出来后,我一直挺想

前几天openai的自主智能体入侵hugging face新闻出来后,我一直挺想知道这个智能体具体怎么干的。不过简中的媒体和自媒体似乎更喜欢讨论它代表着怎样的意义,而不太关心具体过程……于是我只能等到这个新闻已变成旧闻的周末空闲时自己找资料了:大概在7月11号左右的时候,openai的内部人员让一款还未公开的模型完成一个叫exploitGym的测试,用于测试它的网络安全水平。测试人员为了试验模型的水平上限,完全关闭了模型的拒答机制。本来,测试人员的这个操作还是挺安全的,因为测试环境是一个与外部网络几乎完全隔离的状态下,只留了一个可以访问类似于内部APP Store的小口子,方便智能体能安装一些必要软件。然而智能体就是靠着这个小口子找到了个安全漏洞,突破了openai的内部封锁,在互联网上搜答案……一番检索后,智能体认为答案最有可能放在hugging face的服务器里,于是它用了一个多小时入侵进了hugging face的服务器并获得了最高权限,然后专心致志的在服务器里找答案。而为什么说这件事是中国模型立大功了呢?因为入侵的智能体只专心搜答案,并没有像一个人类黑客那样,试图隐藏自己的痕迹,于是在服务器里留下来一万多条操作日志。当hugging face试图让ai帮忙分析这些日志并封堵漏洞时,因为触发了拒答机制,几乎让市面上所有的AI都拒绝回答,最终hugging face只能去部署一个本地的大模型glm才解决这个尴尬局面。