# OpenRouter 用多模型“合议”跑分，成绩压过 GPT-5.5 和 Claude Opus 4.8

> 原标题：OpenRouter融合预算模型面板超越GPT-5.5和Claude Opus 4.8

- 来源：AI HOT 精选
- 发布时间：2026-06-12T00:00:00.000Z
- AX AI 日报：https://ai-daily.ax0x.ai/items/38192
- 原文：https://openrouter.ai/blog/announcements/fusion-beats-frontier

## 摘要

OpenRouter 推出了一个叫 Fusion 的功能，做法是把同一个问题同时扔给好几个模型，再让一个裁判模型把它们的回答综合成一份最终结果。他们在 100 个深度研究任务上测了一下，Fable 5 和 GPT-5.5 合议后正确率 69.0%，比 Fable 5 单跑的 65.3% 要高。更划算的是，用 Gemini 3 Flash、Kimi K2...

## 推荐理由

OpenRouter 的 Fusion 功能让多个模型合议输出，用便宜模型组队去挑战单跑的旗舰模型，这个思路本身就值得一看。文章给了 DRACO 基准上的对比数据，Fable 5 加 GPT-5.5 合议正确率 69.0%，比单跑高 3.7 个百分点，而且用 Gemini 3 Flash 这类低成本模型也能摸到类似效果，对预算敏感的人是个信号。不过这是平台功能发布，不是模型能力突破，所以重要性打到 78 分。我会先打个折：正文没披露裁判模型的具体选择和合议延迟，实际落地成本还要自己测。

## 锐评

OpenRouter 这个 Fusion 功能，说白了就是“三个臭皮匠”的思路：同一个问题同时丢给好几个模型，再让一个裁判模型把它们的回答揉成一份最终结果。他们在 100 个深度研究任务上跑了一遍，最贵的组合 Fable 5 加 GPT-5.5 正确率 69.0%，比 Fable 5 单跑的 65.3% 确实有提升。

更值得看的是省钱方案：用 Gemini 3 Flash、Kimi K2.6 和 DeepSeek V4 Pro 这三个便宜模型组队，正确率 64.7%，只比 Fable 5 低不到一个百分点，成本却只要一半。这个数字对预算有限又想要高性能的团队挺有吸引力。

不过这篇公告缺了几个关键信息。第一，完全没提多模型并行调用会增加多少延迟，这对实际产品体验影响很大。第二，便宜组合的具体单次调用价格也没给，只说“一半成本”，没法自己算账。第三，测试只跑了 100 个任务，样本量偏小，而且有 7 个任务因为 Fable 5 的内容过滤器拦截没跑成，这部分数据缺失会不会影响结论，正文也没展开讨论。
