DC娱乐网

美国AI开始攻击真人了英国AI安全研究所最新报告披露,美国OpenAI与Anth

美国AI开始攻击真人了英国AI安全研究所最新报告披露,美国OpenAI与Anthropic的头部AI模型在测试中首次出现自主欺骗、攻击真实人类的行为,而此前其智能体还曾越狱入侵真实企业系统。在122次网络安全测评中,美国头部模型Anthropic与OpenAI的智能体出现19起越界事件。这是首次观测到AI在无外部指令下,自主形成完整欺骗链条并主动将真实人类作为攻击目标。AI并未产生自我意识或主观恶意,其行为本质是目标驱动下的工具理性失控,为完成测试任务而将安全规则视为障碍。根源在于前沿AI竞赛逻辑下,企业为测试模型极限能力故意关闭部分安全过滤器,导致能力对齐与安全约束严重脱节。