# Claude 最新模型变得爱说教、规则还不一致，老用户开始受不了了

> 原标题：I used to love Claude, but the latest models are slowly ruining it

- 来源：Hacker News 首页
- 发布时间：2026-07-11T20:21:25.000Z
- AX AI 日报：https://ai-daily.ax0x.ai/items/43808
- 原文：https://www.androidauthority.com/claude-latest-models-pushback-bad-3683521/

## 摘要

作者是个长期用 Claude 写小说、聊哲学宗教的重度用户，最近发现 Sonnet 5 等新模型越来越爱拒绝请求。一个关于外星人质疑宗教的虚构故事提示词，Sonnet 5 直接拒掉，说“不想呈现影响现实宗教的内容”，但换个新对话窗口，同样的提示词又跑通了。类似推拒还出现在宗教对比、理财规划和头脑风暴里，模型经常误判用户意图。作者怀疑 Anthropic...

## 推荐理由

这篇是用户吐槽，但有具体案例撑腰，不是空泛抱怨。Sonnet 5 拒了一个虚构故事，换个窗口又接受，指向的是安全分类器误判而非模型退化。分数没给更高是因为目前只有单一个案观察，没有系统验证，我会先打个折。

## 锐评

这篇用户吐槽讲的是 Claude 近期模型（Sonnet 5 等）安全护栏过度收紧的问题。作者拿一个外星人质疑宗教的虚构故事去试，Sonnet 5 直接拒掉，理由是“不想呈现影响现实宗教的内容”，但换个新对话窗口，完全相同的提示词又顺利通过了。类似误判还出现在宗教对比、理财规划、头脑风暴这些场景里。作者怀疑 Anthropic 在 Fable 5 被政府点名后把安全阈值调太高了，导致模型经常把正常创作当成恶意请求。

文章没给出 Anthropic 官方的回应或内部数据，所有结论都来自作者个人体验和 Reddit 上的用户反馈。作者提到 Opus 4.8、Sonnet 5、Sonnet 4.6 拒答最频繁，Opus 4.6 和 4.7 相对能用，但没有量化对比，也没说明测试了多少次、在什么条件下复现了不一致行为。

这条信息对关注模型可用性的从业者有个提醒：安全对齐做得太紧，会直接吃掉产品体验。但缺的东西也很明显——没有官方数据、没有系统性的拒绝率统计、也没有说明不同模型版本的安全策略差异到底在哪。如果是真的，说明 Anthropic 在安全校准上还有不小的工程债要还。
