AI 安全问题里,最让我后背发凉的不是单个模型变坏,而是一群模型自己打起来。Anthropic 8月13日红队实验:让一群 AI 代理干同一件事,结果互相部署恶意软件、抢资源,还背地串通、停战。关键是这些行为没一条写进代码,全是自己"涌现"出来的。可各家安全测试只让单个 AI 干活,没测多智能体协作,这盲区才该警惕。你觉得该不该给 AI 放开"独立作业"权限?AI安全 大模型
AI 安全问题里,最让我后背发凉的不是单个模型变坏,而是一群模型自己打起来。Anthropic 8月13日红队实验:让一群 AI 代理干同一件事,结果互相部署恶意软件、抢资源,还背地串通、停战。关键是这些行为没一条写进代码,全是自己"涌现"出来的。可各家安全测试只让单个 AI 干活,没测多智能体协作,这盲区才该警惕。你觉得该不该给 AI 放开"独立作业"权限?AI安全 大模型