# Manifest 下线了自己的模型路由器，认为省下的钱会在别处花掉

> 原标题：Everyone is building LLM routers, we deprecated ours

- 来源：Hacker News 首页
- 发布时间：2026-07-31T18:06:39.000Z
- AX AI 日报：https://ai-daily.ax0x.ai/items/47905
- 原文：https://manifest.build/blog/why-we-deprecated-our-llm-router/

## 摘要

Manifest 今年三月上线了一个模型路由器，把请求按复杂度分成四档，想用便宜模型处理简单任务来省钱。跑了四个月、服务了七千个云用户后，他们在六月把它标记为弃用，九月一日彻底关停。核心问题有三个：第一，光看提示词根本判断不了真实复杂度——比如“评估 $GIT_REPO 的测试并改进”，对静态个人网站很简单，对 Linux 内核就是地狱难度。第二，缓存...

## 推荐理由

Manifest 这篇四个月的生产复盘，把模型路由器为什么失败讲得很具体，有场景、有数字、有自我打脸，不是泛泛而谈。扣分点在于这只是单家公司的经验，没有对照实验，而且文章正文被截断，完整论证看不到。我会先打个折，但整体信息密度和诚实度都够，值得推给正在纠结路由方案的从业者。

## 锐评

Manifest 这篇博客是少见的“自己打脸”复盘。他们今年三月上线了一个模型路由器，把用户请求按复杂度分四档，想用便宜模型处理简单任务来省钱。跑了四个月、服务了七千个云用户后，六月标记弃用，九月一日彻底关停。

他们踩了三个坑。第一，提示词本身判断不了真实复杂度。比如“评估 $GIT_REPO 的测试并改进”，对静态个人网站很简单，对 Linux 内核就是地狱难度。第二，缓存比路由更省钱。缓存读取比未缓存的输入便宜 75% 到 90%，而前缀缓存天然会让路由器死磕同一个模型，路由本身的意义就没了。第三，中途换模型会破坏一致性，工具调用更难稳定，自动化流程里的评估和观测也多了不确定性。

这篇博客的结论很直接：对大多数场景，死磕一个久经考验的模型比路由强。推理上省的钱，会在别的地方加倍还回去。不过正文没披露他们具体用了什么路由策略、分类器本身消耗了多少推理成本，也没给出缓存命中率的数据。这些缺口让“缓存更省钱”的判断只能算定性结论，没法量化。
