# Anthropic 发现并阻止了多起用 Claude 尝试开发生物武器的案例

> 原标题：Anthropic blocks 'malicious use' of AI that could develop biological weapons

- 来源：Hacker News 首页
- 发布时间：2026-09-11T06:19:06.000Z
- AX AI 日报：https://ai-daily.ax0x.ai/items/55889
- 原文：https://www.bbc.com/news/articles/cx2zrrpkx20o

## 摘要

Anthropic 在 2025 年 12 月到 2026 年 8 月期间，一共打断了 5 起可能用于开发生物武器的滥用行为，涉及 Claude Haiku、Sonnet 和 Opus 三个模型。报告里说，生物滥用是前沿模型最严重的风险之一，因为能造疫苗的知识同样也能造武器。除了生物武器，他们还发现有人用 Claude 写常规武器的控制软件，以及俄罗斯...

## 推荐理由

Anthropic 自己主动披露了安全干预数据，在 8 个月里拦下了 5 起试图用 Claude 搞生物武器的滥用，覆盖 Haiku、Sonnet 和 Opus 三个模型，还直接点了俄罗斯的名。这不是公关稿，是前沿模型安全治理的硬证据。分数没给到 85 以上，主要是因为报告里没披露拦截机制的具体细节和误报率，但作为行业首次公开这类数据，82 分站得住。

## 锐评

Anthropic 在最新的威胁情报报告里说，从 2025 年 12 月到 2026 年 8 月，他们打断了 5 起可能用于开发生物武器的滥用行为，涉及 Claude Haiku、Sonnet 和 Opus 三个模型。报告把生物滥用列为前沿模型最严重的风险之一，理由是能造疫苗的知识同样也能造武器。这个逻辑本身没毛病，但报告只给了案例数量，没披露这些尝试到底走到了哪一步、模型输出了什么内容、以及判断标准是什么。正文没披露这些关键信息，所以这 5 起事件的严重程度很难独立评估。

除了生物武器，报告还提到有人用 Claude 写常规武器的控制软件，以及俄罗斯关联的网络间谍活动、伊朗的宣传机构滥用、中国 AI 公司的模型蒸馏等。这些发现来自 Anthropic 自己的监测，他们表示已经把结论反馈到内部流程并分享给了当局。但整份报告是公司单方面发布，没有第三方验证，读的时候得留个心眼。

还缺什么：报告没说明这些拦截是自动触发还是人工审核发现的，也没给出误报率。生物武器那 5 个案例的具体对话内容、用户身份、后续执法跟进情况全都没提。这些缺口让报告更像一次安全能力的对外展示，而不是可复盘的威胁评估。
