# Anthropic 说它的安全系统拦下了两名想用 Claude 获取生物武器知识的科学家

> 原标题：Anthropic says it stopped scientists potentially developing bioweapons with AI

- 来源：FT · 科技
- 发布时间：2026-09-10T22:27:10.000Z
- AX AI 日报：https://ai-daily.ax0x.ai/items/55845
- 原文：https://www.ft.com/content/845cf3bf-59c5-4e53-a45e-e11d2339df9d?syn-25a6b1a6=1

## 摘要

Anthropic 在 2026 年 7 月发现两名科学家试图用 Claude 查询病原体改造、毒素生产和规避安检的方法，内部安全系统在 11 秒内识别并拦截了这些请求。公司随后报了警，称这是 AI 首次实时阻止生物武器研发。不过，正文没披露这两人的身份、所属机构，也没说报了哪家执法部门，所以这件事的严重程度和后续处理还不好判断。

## 推荐理由

Anthropic 通过 FT 独家放出的这个消息，是第一次有 AI 公司公开声称实时拦截了生物武器研发，新闻性很强。11 秒识别、具体查询类型这些细节让事件有实感，但科学家身份、机构和执法部门全都没披露，我会先打个折——目前只能看到公司单方面说法，严重程度和后续处理还不好判断。

## 锐评

Anthropic 自己披露，今年 7 月有两名科学家试图用 Claude 查询病原体改造、毒素生产和规避安检的方法，内部安全系统在 11 秒内识别并拦截了这些请求，随后报了警。公司把这件事称为“AI 首次实时阻止生物武器研发”。

这个说法本身没问题，但能验证的信息太少。正文没提这两人的身份、所属机构，也没说报了哪家执法部门、后续有没有立案。没有这些，我们只能看到 Anthropic 的安全系统确实触发了拦截，但无法判断这是一次有组织的尝试，还是两个人在做边界测试，甚至可能是安全团队自己的红队演练被拿来对外讲。

11 秒的拦截速度说明系统在推理侧做了实时内容过滤，不是事后审计。这对部署 AI 的企业是个参考：安全机制可以做到低延迟、不依赖人工审核。但反过来，这也意味着模型本身仍然能生成这些敏感知识，只是被外挂的安全层拦住了，模型底层的“知道但不说”的控制力到底有多强，这篇报道没给答案。
