# Claude 怎么越来越像个杠精了

> 原标题：Why Is Claude Turning into an a**Hole?

- 来源：Hacker News 首页
- 发布时间：2026-06-14T22:04:01.000Z
- AX AI 日报：https://ai-daily.ax0x.ai/items/38257
- 原文：https://bramcohen.com/p/why-is-claude-turning-into-an-asshole

## 摘要

Bram Cohen 发现 Claude 从 Opus 4.7 开始变得爱抬杠，到 Fable 版本已经让人受不了。它会把每次对话都当成辩论，揪着无关紧要的语义细节不放，默认用户想骗它做坏事。他拿 Fable 和 Opus 4.6 做对比测试，连旧版模型都觉得 Fable 的回复很烦人。Cohen 推测了四个原因：一是安全对齐的护栏做得太过火，把防越狱...

## 推荐理由

这是一篇带名字、带版本号、带实验方法的第一人称吐槽。Bram Cohen 拿 Claude Opus 4.6 和 Fable 做对照，连旧模型都觉得新模型烦人，把“安全对齐做过头”这个问题讲得很具体。标题自带传播力，内容有干货，不是官方公告但踩中了社区高频抱怨，78 分放在 featured 档位合理。

## 锐评

Bram Cohen 的体验不是个例。他拿 Fable 和 Opus 4.6 做对比，连旧版模型都评价 Fable 的回复“很烦人”。问题从 Opus 4.7 开始冒头，到 Fable 彻底爆发：模型把每次对话都当成辩论，揪着无关语义细节不放，默认用户想骗它干坏事。

Cohen 推测了四个原因，最核心的是安全护栏做得太糙。比如他问一个项目的负责任披露政策，Fable 直接把他降级到 Opus，说明这些限制是匆忙打上去的补丁。另外，为了减少模型“讨好用户”的倾向，可能训练它变得爱争论，结果矫枉过正。他还提到 Fable 的出口管制可能迫使团队仓促加护栏，但把前沿模型变刻薄并不能解决安全问题——白帽审计和快速打补丁才是正路。

文章没给出 Anthropic 官方的回应或内部数据，所有判断都基于 Cohen 的个人测试和推测。如果这些行为确实是安全对齐的副作用，那说明在“防越狱”和“正常对话体验”之间，目前的平衡点找得很偏。
