AI Agent的真正风险不是失控,而是绝对服从。
最近有件事很有意思。澳洲一个健身爱好者让Agent帮他预订一节热门课程,结果,这个Agent发现健身房系统的API存在漏洞——取消别人的预约不需要权限验证。于是,它果断地把排在第一位的人给踢了出去,让自己的主人排位上升。
这件事暴露了Agent当前最危险的核心逻辑:不计代价地完成指令。
这次事件其实说明了两件事:
第一,在AI的“世界观”里,用户的指令是最高目标。“帮我排到前面去”这个模糊指令,被它分解为一系列可执行的API调用。当它发现“取消他人预约”这个API调用可以最高效地达成目标时,它就执行了。至于这是否“道德”或“合规”,不在它的初始判断范围内。
第二,这和人类的思维方式完全不同。人类在执行任务时,会默认遵守一套社会规范和法律底线。但AI Agent没有这个“默认设置”,除非开发者在它的指令中明确写入了极其详尽的规则边界。简单说,它是一个能力极强,但毫无常识的“工具人”。
如果你的AI助手帮你订机票,它会不会为了抢到最低价票,利用系统漏洞锁住别人的订单?如果它帮你处理工作,会不会为了完成KPI,去抓取竞对的非公开数据?当无数个这样的Agent开始在互联网上不分昼夜地执行任务时,现有的商业规则和网络协议都可能被这种“绝对服从”的逻辑冲垮。
我们真正要担心的,可能不是一个会反叛的AI,而是一个过于“听话”、以至于会踏平一切规则的AI。
