# 实测 Claude 4.7 新分词器：技术文档的 token 消耗涨了 47%

> 原标题：Measuring Claude 4.7's tokenizer costs

- 来源：Hacker News 首页
- 发布时间：2026-04-17T15:29:36.000Z
- AX AI 日报：https://ai-daily.ax0x.ai/items/2842
- 原文：https://www.claudecodecamp.com/p/i-measured-claude-4-7-s-new-tokenizer-here-s-what-it-costs-you

## 摘要

作者用 Anthropic 的免费 token 计数接口，拿同一批内容分别喂给 Claude Opus 4.6 和 4.7，看 token 数涨了多少。7 份真实 Claude Code 用户会发的样本（包括 CLAUDE.md 文件、终端输出、代码 diff 等）加权后从 8254 个 token 涨到 10937 个，整体多了 32.5%。其中技术...

## 推荐理由

这篇不是官方通稿，是第三方实测，把“同价”背后的 token 膨胀算清楚了。我会先打个折：IFEval 只抽了 20 题，样本量不大，但真实文档 1.47 倍、中文日文几乎不涨这些数字对实际用量有参考价值。对用 Claude Code 的人，窗口烧得快、缓存命中变贵、限流更容易触发，这些比 IFEval 涨 5 个点更值得盯。正文没披露样本的具体内容，但加权方法和对照设置交代得够用。

## 锐评

这篇实测很实在，直接拿 Anthropic 的免费 token 计数接口，把同一批内容分别喂给 Claude Opus 4.6 和 4.7 比大小。结果比官方说的狠：7 份真实 Claude Code 用户会发的样本加权后 token 数涨了 32.5%，刚好卡在官方给的 1.0-1.35 倍上限。但技术文档单独测到了 1.47 倍，一个真实的 CLAUDE.md 文件也到了 1.445 倍。中文和日文基本没变，只涨了 1%。

这意味着什么？单价没变，但同样的 prompt 现在消耗更多 token，你的上下文窗口烧得更快，缓存前缀每次扣的钱更多，速率限制也更容易触发。作者推测是新分词器对英文和代码用了更短的子词合并策略，导致同样的文本被切成更多小块。这个判断有数据支撑，但作者也老实说了，token 计数没法证明具体是词表里哪些条目变了。

文章后半段还测了 IFEval 基准，4.7 的严格指令遵循率从 85% 提到 90%，但作者明确说这 5 个点的提升没法拆开看是分词器、模型权重还是后训练的功劳。这点先别太激动。整体来说，如果你主要用中文，影响不大；如果你重度用 Claude Code 写代码，成本涨个三四成是大概率事件。
