# Anthropic 发布 Claude Fable 5/Mythos 5，编程跑分跳到 80.3%，但安全分类器误伤一片，连自家安全报告都封

> 原标题：2026-06-09 群聊日报

- 来源：AI 群聊日报
- 发布时间：2026-06-10T07:39:55.000Z
- AX AI 日报：https://ai-daily.ax0x.ai/items/37498
- 原文：https://louyu2015.github.io/AI-chatgroup-daily/daily/2026/06/09/daily/

## 摘要

Anthropic 一天扔出两款模型：Fable 5 给所有人用，满血版 Mythos 5 只给受信伙伴。SWE-bench Pro 得分 80.3%，比上一代 Opus 4.8 的 69.2% 和 GPT 5.5 的 58.6% 都高出一截，仅靠看屏幕截图就打通了宝可梦火红。定价是 Opus 4.8 的两倍，输入每百万 token 10 美元，输出 ...

## 推荐理由

Anthropic 旗舰模型发布，SWE-bench Pro 冲到 80.3%，远超 GPT 5.5 的 58.6%。定价翻倍但 Coding Plan 可能短期有成本优势。跨源信息确认，HKR 三个维度都打中了。扣 1 分是因为正文没披露 Mythos 5 的具体细节和开放计划，信息有缺口。

## 锐评

Anthropic 一天扔出 Fable 5 和 Mythos 5，SWE-bench Pro 得分 80.3%，比上一代和 GPT 5.5 都高出一截，仅靠看屏幕截图就打通了宝可梦游戏。定价是 Opus 4.8 的两倍，输入每百万 token 10 美元，输出 50 美元。群友判断 200 美元的包月套餐大概值 5000 到 1 万美元的 API 成本，但消耗速度是 Opus 的 2 到 3 倍，有人不到两小时就用掉了 73% 的额度，所以这更像一个短暂的红利窗口。

最大的槽点是安全分类器。问“9.9 减 9.11 等于几”会触发降级，对着 Anthropic 自己的安全报告写分析文章，讨论生物武器防御实验，直接被封请求，最后文章只能换 DeepSeek 写完。这客观上形成了一道价格围栏：需要满血网络安全能力的组织，恰好是能签企业合同、接受数据保留条款的那批人。受约束版本的生产成本反而更高，符合经济学上“故意做差产品”的定义。

安全报告里的稻瘟病实验还揭示了一个变化：AI 正在拉平领域知识的价值，但能判断 AI 答案哪里不靠谱的人，反而变得更值钱。另外，Anthropic 四月份上线的 advisor tool 可能是 Fable 5 的正确省钱用法——让便宜模型干活，遇到拿不准的决策再花几百 token 问贵模型，控制权留在便宜模型手里，避免贵模型越俎代庖。正文没披露 Fable 5 在非编程任务上的长期稳定性数据，也没说安全分类器的误触率具体是多少。
