# Anthropic 新 API 让便宜模型干活、贵模型当军师，Haiku 配 Opus 在 BrowseComp 分数翻倍，成本只要 Sonnet 的 15%

> 原标题：Anthropic 推出了一个叫“顾问工具”（advisor tool）的新 API 功能，核心思路是：让便宜的模型干活，遇到难题时请贵的模型出主意。

- 来源：X · @dotey（宝玉）
- 发布时间：2026-04-09T19:31:34.000Z
- AX AI 日报：https://ai-daily.ax0x.ai/items/3584
- 原文：https://x.com/dotey/status/2042324560700154312

## 摘要

Anthropic 推出了“顾问工具”API，让 Sonnet 或 Haiku 作为执行者跑任务，遇到难决策时把上下文递给 Opus 出主意，Opus 不碰工具、不直接输出，只当幕后军师。这跟常见的“大模型拆任务、小模型执行”反过来了，好处是大部分 token 烧在便宜模型上。Sonnet 配 Opus 在多语言 SWE-bench 上比单干高 2.7...

## 推荐理由

Anthropic 这次 API 更新挺实在，不是画饼。核心就是让 Sonnet 或 Haiku 当执行者跑任务，卡壳时再问 Opus，而且是在同一次 API 请求里完成模型切换，Token 分开算钱。给的数字也清楚：Sonnet+Opus 在多语言 SWE-bench 上比单用 Sonnet 高了 2.7 个百分点，单任务成本还降了 11.9%；Haiku+Opus 在 BrowseComp 上从 19.7% 跳到 41.2%，成本只要 Sonnet 的 15%。我会先打个折，毕竟还在 beta，但这条路子对控制推理成本确实有用，值得关注。

## 锐评

这条更新把模型路由的账算得很清楚。以前是 Opus 当指挥官拆任务，现在 Sonnet 或 Haiku 自己跑，只在关键决策点把上下文递给 Opus 出主意，Opus 不碰工具、不直接输出。好处是大部分 token 消耗在便宜模型上，贵的只在刀刃用。Sonnet 配 Opus 在多语言 SWE-bench 上比单干高 2.7 个百分点，单任务成本还降了 11.9%。更夸张的是 Haiku：配 Opus 顾问后在 BrowseComp 上从 19.7% 跳到 41.2%，翻了一倍多，虽然还是比 Sonnet 单干低 29%，但成本只有 Sonnet 的 15%。

不过要留个心眼。正文只给了两个基准的提升数字，没披露失败案例、延迟增加多少、以及 Opus 被咨询的频率分布。max_uses 能设上限，但如果大部分请求都触发顾问，成本优势就没了。另外，模型切换在一个 API 请求内完成，账单分开计费，这对调试和成本追踪是好事，但也意味着你需要自己监控顾问调用比例。目前是 beta，需要加特定请求头，生产环境先拿小流量试。
