# Claude 写代码时有一套自己的高频词，像“load-bearing”“latent”，在 2026 年的 PR 里已经占了快一半

> 原标题：Show HN: The load-bearing vocabulary of Claude

- 来源：Hacker News 首页
- 发布时间：2026-08-27T08:59:49.000Z
- AX AI 日报：https://ai-daily.ax0x.ai/items/53188
- 原文：https://louisabraham.github.io/load-bearing/

## 摘要

这个项目抓了 595 天里 47,464 个 GitHub PR，用 KL 散度 k-means 把用词风格聚成 8 类。其中一类是 2026 年才冒出来的，上个月已经占到所有“人类署名”PR 的 45%。这类 PR 里最扎眼的词——load-bearing、latent、genuine、seam、ladder——跟 Claude Code 用户反馈的...

## 推荐理由

方法论扎实（KL 散度 k-means 聚类 595 天 47k 个 PR），发现也够炸：Claude Code 的用词风格簇现在出现在 45% 的人类署名 PR 里。属于观察性研究而非产品发布，所以分数卡在 78。

## 锐评

这个项目用KL散度k-means把近6万份PR按用词风格聚成8类，其中一类2026年才出现，上个月已经占到所有“人类署名”PR的45%。这类PR的高频词——load-bearing、latent、genuine、seam、ladder——跟Claude Code用户反馈的措辞高度重合，作者认为这是Claude写作风格的指纹，不是人类自然用词。load-bearing这个词在聚类里的出现频率是整体语料库的123倍，这个数字很夸张，说明风格信号非常强。

但这里有个关键缺口：正文没解释“人类署名”是怎么判定的。如果只是看PR作者字段有没有写“Claude”或“AI”，那大量用AI辅助但没标注的提交就会被算成人类提交，45%这个数字可能被高估。另外，聚类本身只能说明用词风格趋同，不能直接证明这些PR就是AI写的——也可能是开发者看了Claude的输出后模仿了它的措辞。

我会先给这个结论打个折：风格指纹确实存在，但“45%的人类PR其实是AI写的”这个解读需要更硬的证据链，比如对比这些PR的提交时间分布、代码修改模式，或者抽样做人工标注验证。
