# Anthropic 给 Claude Fable 5 的生物安全过滤器松了绑，误拦率砍掉约 85%

> 原标题：Anthropic 更新 Claude Fable 5 生物安全防护，误报率大幅降低

- 来源：AI HOT 精选
- 发布时间：2026-08-07T02:41:46.636Z
- AX AI 日报：https://ai-daily.ax0x.ai/items/49197
- 原文：https://www.anthropic.com/news/improving-fable-5-s-biology-safeguards

## 摘要

Anthropic 重写了 Fable 5 的生物安全分类器，把日常健康、教育类提问被误拦、降级到 Opus 5 的情况减少了大约 85%。之前为了防滥用，Fable 5 上线时几乎把所有生物相关提问都拦了，导致很多正常问题也被迫用更笨的模型回答。这次他们找了一帮内外部专家，重新梳理了分类器的判定规则，把无害用途从拦截范围里仔细抠了出来，再拿新规则训练...

## 推荐理由

Anthropic发了一篇官方安全更新，给出了85%这个具体的误报降低数字，并解释了做法——专家重写分类规则，把无害用途摘出来再训练。对关注AI安全部署细节的人有干货，也回应了用户之前抱怨正常问题被误拦的痛点，值得推荐。

## 锐评

这次更新解决的是一个上线时留下的“宁可错杀”问题。Fable 5 刚发布时，Anthropic 担心模型在生物领域的强能力被滥用，几乎把所有生物相关提问都拦截并降级到能力更弱的 Opus 5 去回答。现在他们找了内外专家重新梳理规则，把无害的日常健康、教育类问题从拦截名单里仔细抠了出来，效果很直接：生物相关的降级减少了大约 85%。

不过别误会，这不是全面放开。病毒学、毒理学、分子设计这些“双重用途”领域依然被卡死，Fable 5 目前还是不能用于专业生物研究和药物开发。Anthropic 自己也在正文里承认，区分善意研究和恶意用途很难——比如研发降压药卡托普利时，科学家就是从蛇毒里分离有毒成分的。他们引用美国情报界 2026 年威胁评估，指出有国家行为体在维持进攻性生物武器计划，所以对前沿模型的能力释放很谨慎。

正文没披露这次重训分类器具体用了多少专家样本、误拦率下降后有没有新的漏网案例，也没说“可信访问通道”什么时候能落地。所以这次进步值得肯定，但离“让生物学家用上最前沿模型”还有不小距离。
