# Ramp 推出模型路由器，声称平均能砍掉 40% 的推理成本

> 原标题：Ramp Launches a Model Router

- 来源：Hacker News 首页
- 发布时间：2026-08-19T19:26:18.000Z
- AX AI 日报：https://ai-daily.ax0x.ai/items/51671
- 原文：https://router.com

## 摘要

Ramp 把省钱基因用到了模型推理上。Router 是一个统一接口，每次请求自动挑一个最便宜但能满足你性能要求的模型来跑，覆盖了 Anthropic、OpenAI、Grok、Fireworks 等多家。一个演示里，用 Router 跑一趟花了 45.62 美元，而直接调一个通用前沿模型要 297.85 美元。客户 Delphi 说，在跑了数十亿个 to...

## 推荐理由

Ramp 发布了一个模型路由层，核心就是每次请求自动选最便宜的模型来跑，演示里成本从 298 美元降到 45 美元，对跑大量推理的团队很实用。不过这是刚发布的新东西，还没有第三方实测数据，所以分数先打个折。

## 锐评

Ramp 把省钱思路搬到了模型推理上，推出一个叫 Router 的统一接口。你发一次请求，它自动在 Anthropic、OpenAI、Grok 等多家模型里挑一个最便宜、又能满足你性能要求的来跑。官方演示里，用 Router 跑一趟花了 45.62 美元，直接调一个通用前沿模型要 297.85 美元，省了八成多。客户 Delphi 说跑了数十亿个 token 后，模型成本降了 92%。2026 年底前路由功能免费，还送 26 美元额度。

这些数字看着漂亮，但得打个折。正文没披露路由决策带来的额外延迟是多少，也没说如果首选模型挂了怎么 fallback。成本对比的基准是“通用前沿模型”，没说明具体是哪家、什么规格，这个参照系有点模糊。另外，所有数据都来自 Ramp 自己，没有第三方跑分或独立验证。

现在还缺几块关键信息：不同任务类型下的性能一致性怎么样、路由策略多久更新一次、以及大规模跑起来后延迟会不会明显增加。如果这些都能补上，对用量大的团队确实挺省钱。
