# Spotify 工程师用 Portal 把 Claude Code 的 token 用量砍了九成

> 原标题：Portal by Spotify cut my Claude Code token usage by 90%

- 来源：Hacker News 首页
- 发布时间：2026-09-04T23:38:50.000Z
- AX AI 日报：https://ai-daily.ax0x.ai/items/54856
- 原文：https://engineering.atspotify.com/2026/9/portal-by-spotify-cut-my-claude-code-token-usage-by-90

## 摘要

一个 Spotify 工程师发现 Claude Code 大部分 token 都花在了读大文件、生成样板代码这类没什么推理量的 I/O 活上。他用 Spotify 内部的 Portal 平台建了两个“模式”，把这类粗活路由到更便宜的 Gemini 2.5 Flash 去干：一个负责批量读文件回答问题，一个负责照着现有代码风格生成测试和配置。再配合一个叫...

## 推荐理由

Spotify 工程师的第一手实验，有具体数字和路由策略，不是泛泛的省钱建议。HKR 三个维度都踩中了，但本质是工程实践分享，不是产品发布或研究突破，所以定在 78 分、featured 层级。

## 锐评

这篇东西最值钱的地方在于它把“省钱”这个事讲得很具体。作者发现 AI 编程助手大部分 token 都烧在了 I/O 上，比如读几个大文件回答一个问题，或者照着现有代码风格生成测试。他用 Spotify 内部的 Portal 平台建了两个“模式”，一个负责批量读文件，一个负责生成样板代码，把这些粗活丢给 Gemini 2.5 Flash 去跑。再配合一个叫 shunt 的插件，自动拦截超过 350 行的文件读取请求，强制走便宜模型。结果 token 用量降了 90%。

不过正文没披露具体省了多少钱，只引用了 Gartner 的一个预测，说 2028 年 AI 编程成本会超过开发者的平均工资。这点先别太激动，90% 是 token 减少的比例，不是账单直接打一折，因为便宜模型的单价本来就更低。另外，这套方案强依赖 Spotify 内部的 Portal 平台，外部团队没法直接抄作业。还缺一个关键信息：便宜模型生成的代码质量到底怎么样，有没有引入更多 bug 或者需要额外的人工返工。如果返工成本把省下的 token 费又吃回去了，那就不划算了。
