# Fireworks AI 把路由器打包成独立模型端点，写代码成本降了 57%

> 原标题：Fireworks AI 推出 FireRouter with Opus，编码任务成本降 57%

- 来源：AI HOT 精选
- 发布时间：2026-09-27T16:00:00.000Z
- AX AI 日报：https://ai-daily.ax0x.ai/items/59552
- 原文：https://fireworks.ai/blog/introducing-firerouter-with-opus

## 摘要

Fireworks AI 把自家的缓存感知路由器 FireRouter 单独拿出来，做成了一个叫 FireRouter with Opus 的模型端点。它会在每次对话回合里，自动从 Claude Opus 5.5、GLM 5.3 和 GLM 5.3 Flash 三个模型里挑一个最划算的来用。内部 A/B 测试跑了一个多月，主要看写代码任务：跟纯用 Op...

## 推荐理由

Fireworks 把 Opus 5.5 的路由成本压了 57%，有内部 A/B 数据撑着，对日常用 Claude 写代码的人确实省钱。没给 p1 是因为这本质是路由层的优化，不是模型能力有突破，而且数字全来自 Fireworks 自己，还没第三方复现。

## 锐评

Fireworks AI 把自家那个能感知缓存的路由器 FireRouter 单独拎出来，做成了一个叫 FireRouter with Opus 的模型端点。它会在每次对话回合里，自动从 Claude Opus 5.5、GLM 5.3 和 GLM 5.3 Flash 三个模型里挑一个最划算的来用。内部 A/B 测试跑了一个多月，主要看写代码任务：跟纯用 Opus 比，准确率保住了 98.1%，但每次会话成本从 15.36 美元降到了 6.63 美元，省了 57%。

这个省钱不是白来的。路由器故意牺牲了大约 3.6 个百分点的缓存命中率（从 97.8% 降到 94.2%），换来的是把很多常规回合甩给更便宜的模型去跑。正文没披露 GLM 那两个模型在非编码任务上的表现，也没说这 57% 的降幅在不同项目里波动有多大（误差范围给了 ±19 个百分点，说明实际效果可能差挺多）。

目前只支持 Claude Code、Codex、Cursor IDE 这几个工具，两条命令就能接上。如果你团队已经在用 Opus 写代码，这个端点值得试试，但别指望它在所有场景下都这么省——测试流量主要来自内部编码工作，其他任务类型的效果还没公开数据。
