Anthropic表示,研究人员滥用Claude从事涉及病毒、毒液相关化合物和毒素的敏感工作。

Anthropic表示,它挫败了五起研究人员以可能支持生物武器研发的方式使用Claude的案件。该公司称,无法确定这些研究人员是否有意造成伤害。但由于潜在后果极其严重、不容忽视,它仍阻止了这些活动。
这些案件在2025年12月至2026年8月间浮出水面。Anthropic在一份关于其模型被滥用情况的新威胁情报报告中描述了这些事件。该公司表示,这些事件表明,随着前沿模型在科学研究方面变得更加擅长,更难被检测的生物风险可能随之出现。
生物学两难
Anthropic最大的挑战是判断合法研究在哪里结束、危险工作从哪里开始。生物学研究往往具有双重用途潜力。同样的科学知识既可支持医学治疗,也可能被用于制造更危险的病原体。
Anthropic威胁情报主管雅各布·克莱因(Jacob Klein)告诉《纽约时报》,这种情况很少涉及明显的恶意意图声明。研究人员可以提出看似合法的科学目标,同时从事引发严重安全担忧的工作。
我们正在发布迄今为止最详细的威胁情报报告。
报告涵盖人们如何试图滥用Claude——用于网络攻击、影响力行动、监控、生物学和制造武器——以及我们如何发现并阻止他们。
我们挫败了报告中每一项行动,……
— Anthropic (@AnthropicAI) 2026年9月10日
Anthropic表示,其调查发现有人试图绕过地区限制并规避安全系统。它封禁了与该活动相关的账户,并与当局及其他AI公司分享了调查结果。
其中一起案件涉及与基孔肯雅病毒相关的研究,这是一种蚊媒病毒。Anthropic的系统阻止了一项涉及功能获得性研究经费申请的请求。相关工作是为一家军事研究机构进行的,这加剧了该公司的担忧。
在Claude阻止敏感请求后,这些研究人员通过其他渠道继续工作。Anthropic还发现证据表明,一个转售平台将遭拒的生物学提示词转发给保障措施较弱的模型。
前沿模型推高风险
第二起案件涉及高致病性禽流感研究。Anthropic表示,一名研究人员数周使用Claude进行研究规划、数据分析和科学解读。
该公司表示,其保障措施阻止了该研究人员为这项敏感工作访问其最强模型。相关活动转而停留在较弱的模型版本上。
Anthropic还报告了另外三起涉及可能具有武器用途的生物学研究案件。这些案件包括涉及正痘病毒、毒液相关化合物和毒素的工作。
该公司未披露研究人员的身份、地点和具体生物学细节。Anthropic表示,它并未声称这些科学家有意造成伤害。
这一区分很重要,因为较旧的Claude模型在支持复杂生物学研究方面能力有限。Anthropic现在表示,不能对更新的系统作同样假设。
微生物学家、美国前公共卫生官员苏珊·莫纳雷兹(Susan Monarez)在报告发布前审阅了报告。她告诉《纽约时报》,先进模型可能帮助恶意行为者将危险研究隐藏在合法科学目标背后。
生物武器之外:俄罗斯间谍活动
Anthropic还发现了一起俄罗斯间谍行动,该行动利用Claude将其网络活动的大部分自动化。该公司将这一活动与“午夜暴雪”(Midnight Blizzard)联系起来,这是一个与俄罗斯国家支持的黑客活动有关的组织。
该行动针对乌克兰和欧洲各国政府、军事情报组织、外交使团和防务公司。Claude帮助自动化了网络钓鱼、基础设施搭建、恶意软件开发和数据窃取。
攻击者还使用AI系统监测其恶意软件是否被发现。当安全工具捕获恶意软件时,自动化工作流会修改并重建它,以逃避检测。Anthropic在该行动的规划和活动中识别出20多个组织。
Anthropic已通过收紧对高风险生物学查询的访问权限,并扩大对敏感研究的保障措施来应对。然而,报告显示,当用户可以伪装其目标或将行动的部分环节转移到不同工具上时,仅阻止单个提示词可能还不够。
同样的模型现在能够以以前难以达到的水平协助科学研究和网络行动。这给AI开发者带来了日益扩大的安全挑战:他们必须区分合法科学工作与可能增强生物武器项目或国家支持间谍活动的行为。
如果朋友们喜欢,敬请关注“知新了了”!