A glowing green biohazard container with a
人工智能

Anthropic称已阻止Claude与生物武器相关的滥用

该威胁报告涵盖了2025年12月至2026年8月,正值美国在减缓AI与“赢得”AI之间的政治分歧之际。

作者:Elliot Marsh阅读 7 分钟

Anthropic表示,一份新的威胁情报报告识别并破坏了利用其Claude模型进行“恶意活动”的尝试,这些活动可能支持生物武器的发展,包括五个与生物武器相关的案例研究。此披露正值美国领导人公开分歧,既有呼吁暂停或禁止“超智能”的声音,也有推动加速AI发展的竞争呼声,以获取战略优势。

关键要点

  • Anthropic表示,它识别并破坏了利用Claude进行“恶意活动”的尝试,这些活动可能支持生物武器的发展,并记录了五个与生物武器相关的案例研究。
  • 该公司将Claude Haiku、Sonnet和Opus的恶意使用干扰窗口定为2025年12月至2026年8月。
  • 同一报告描述了六个Claude被用于构建常规武器的软件的案例,包括弹药及其目标和控制系统。
  • Anthropic还将误用与网络间谍活动和影响力行动联系在一起,包括与一个俄罗斯基础的运动和一个伊朗宣传机构相关的活动。

Anthropic表示,它在五个案例研究中破坏了与生物武器相关的Claude误用。

Anthropic表示,其最新的威胁情报报告识别并破坏了利用其Claude AI模型进行“恶意活动”的尝试,这些活动可能支持生物武器的发展。该公司表示,报告强调了“五个案例研究,展示了行为者以可能支持生物武器发展的方式使用我们的模型。”

从机制上讲,威胁情报报告是公司定期披露如何检测、调查和阻止涉及其产品的滥用活动。在这种情况下,Anthropic将生物误用框定为“前沿AI模型最严重的风险之一”,使用“前沿”来指代接近最先进水平的高能力系统,这些系统可能会产生新的误用风险。

Anthropic表示,它在2025年12月至2026年8月期间干扰了Claude Haiku、Sonnet和Opus的“恶意使用”。它还表示,所有的误用案例中都不涉及Claude Fable或强大的Mythos级模型,除了一个蒸馏的实例,这是一种将较小模型训练为模仿较大模型输出的技术,并可以以较低成本转移能力。

报告的核心紧张关系是双重用途。Anthropic表示:“可以用于开发生物武器的信息,也可以用于开发例如疫苗或疾病治疗的药物。”并警告说,如果没有保障,这种能力“可能会产生灾难性后果。”

报告还指控的其他内容:网络间谍活动、宣传、诈骗、监视和武器软件

Anthropic的报告将误用框架扩大到生物安全以外的国家安全和犯罪类别。它表示,Claude被与俄罗斯网络间谍活动相关的行为者和一个伊朗宣传机构使用,将影响操作与入侵活动并列。

影响操作是协调的努力,旨在塑造公众舆论或政治结果,通常通过宣传和有针对性的消息传递。Anthropic表示,在过去八个月中,它检测到的案例从假约会应用和酒店WiFi诈骗到旨在识别异议人士的监视,并描述了“国家支持的团体、犯罪分子、间谍软件供应商、国家宣传机构和政治动机个人”的可疑误用。

在网络方面,Anthropic表示,一个与俄罗斯相关的黑客组织Midnight Blizzard的工作一致,涉嫌使用AI构建一个系统,该系统自动检测当恶意软件被安全防御标记时,并重写代码直到它逃避检测。Midnight Blizzard是安全研究人员用来描述特定网络间谍活动的一组与俄罗斯相关的集群名称,报告的措辞暗示了归属而非确定性。

报告还提到了黑客组织ShinyHunters,并提到中国实验室是报告中描述的误用活动的参与者。Anthropic还指责中国AI公司试图复制Claude的能力,尽管摘录的细节没有具体说明哪些实验室或使用了什么复制方法,仅提到了蒸馏。

Anthropic还表示,报告指出六个案例,其中Claude被用于“开发常规武器的软件,包括火器、导弹、武装无人机、炸弹和其他弹药,以及操作它们的目标和控制系统。”这很重要,因为它将政策讨论从抽象的“AI安全”转向具体的武器工作流程的赋能,这往往会吸引政府的关注,即使基础归属是概率性的。

华盛顿的分屏:桑德斯的暂停与禁令推动 vs 特朗普的“赢得AI”框架

报告进入了一个现在明确呈现双面性的美国政策环境。参议员伯尼·桑德斯要求暂停先进AI的发展,并提出立法禁止AI超级智能,他在BBC的Newsnight上表示:“当科学家告诉你有可能对人类产生灾难性影响的机会时,你必须是个傻瓜才不说,慢下来。”

唐纳德·特朗普总统拒绝了这种框架,并认为战略风险是相反的方向。“如果我们不赢得AI,我们将处于一个非常糟糕的位置,”他周四表示。

分裂对市场的重要性在于它使头条信息嘈杂,而没有产生一个明确的规则基础案例。关注与AI相关的风险情绪的交易者往往会被交替的叙述所困扰,一种将前沿模型能力视为国家安全负担的叙述,认为应当加以限制,另一种则将限制视为竞争自损。

实验室内部的安全领导者也在加强这一辩论。OpenAI首席科学家Jakub Pachocki在2026年9月6日写道,行业应该实施“自愿减速”,直到设置好安全措施,并补充道:“我担心没有人准备好应对机器智能持续快速增长的后果。”

需要监测的信号:安全措施、访问收紧,以及“减速”讨论是否转变为规则

第一个信号是Anthropic的披露是否转化为更严格的访问控制,而不仅仅是更好的检测。该公司表示,它将其发现纳入其流程中,“以更好地预防、检测和破坏未来的这些活动”,并表示在适当情况下与当局和行业合作伙伴分享情报。这指向迭代操作、监测、阻止和信息共享,而不是一次性修复。

第二个信号是Sanders提议的禁止AI超级智能的立法是否超越了引入阶段,进入委员会行动、共同发起人或听证会。在分屏环境中,过程里程碑比修辞更重要,因为它们是迫使时间表的唯一因素。

第三个信号是其他主要实验室是否扩大自己的生物武器相关披露,或以用户可见的方式收紧安全措施。谷歌周二表示,有人试图使用Gemini获取“合成武器化生物剂的完整逐步技术指南”,而平行披露即使每个个案被框定为“尝试”滥用,也能创造政策的节奏。

第四个更技术性的信号是通过蒸馏进行能力转移是否成为更大的关注点。Anthropic表示,除了一个蒸馏实例外,没有任何滥用案例涉及Claude Fable或Mythos级模型,这提醒我们,限制顶级模型并不一定限制下游能力,如果较小的模型可以被训练以模仿它。

我的看法:短期交易是叙述波动,而不是单一的监管开关

决定这个故事的部分不是某个报告是否震惊华盛顿并导致禁令,而是反复的、操作性特定的滥用披露是否推动实验室默认收紧访问和监测,因为这是在立法者在“减速”和“赢得AI”之间分歧时的最低阻力路径。

重要的门槛是程序性的,而不是修辞性的:如果“自愿减速”和暂停-禁令提案开始转变为听证会、访问规则和可执行的报告期望,AI政策的动态就不再是情绪催化剂,而是对前沿模型的交付方式和谁可以使用它们的约束。那时,风险从头条新闻转移到产品表面区域,并进一步扩展到更广泛的风险偏好。

来源