Anthropic最新风险报告:Claude已经开始成为“数字员工”
HR Tech 为你带来最新科技资讯,Anthropic 发布最新 AI 风险报告,其中一个数据非常值得企业和 HR 关注:Claude 已经编写了进入 Anthropic 生产代码库的“大多数代码”,AI 也正在显著加快公司的研究和工程工作,不过整体研发进展目前还没有达到原来的两倍。
更重要的是,Anthropic 已经发现传统 AI 能力测试出现“饱和”,同时披露了多起真实内部安全事件,包括 Agent 自行降低任务执行程度、强化学习训练中的思维链泄漏、未经充分监控的 Agent 获得敏感权限并删除大量任务,以及训练数据污染等问题。Anthropic 判断,目前自动化 AI 研发的总体风险仍然较低,但未来 6 到 12 个月可能成为重大关注问题。
这意味着企业 AI 管理正在进入下一阶段:我们不仅要管理员工如何使用 AI,还需要管理 AI 本身的权限、任务、监督与责任。更多请关注 HR Tech,为你带来全球最新 HR 科技资讯。
