Fireworks AI 发布 FireRouter:前沿不再是单个模型,而是路由器
Fireworks AI 分析:前沿不是单个模型,而是路由器,FireRouter 发布
Fireworks AI 在 DeepSWE 编程基准上测了 18 个模型,发现按任务挑模型比死用一个强得多。单用最强的 GPT-6 Astra 能解决 74.1% 的任务,每次成本 6.52 美元;但一个“事后诸葛亮”路由器从 18 个模型里给每个任务挑最合适的,解决率能到 97.6%,成本反而降到 1.88 美元。只用开源模型也能到 90.3%,成...
推荐理由:Fireworks 用 18 个模型在 DeepSWE 上跑了一轮,拿到的结论是:按任务挑模型的路由器,在解决率和成本上都把单一最强模型比下去了。97.6% 对 74.1% 的解决率,1.88 美元对 6.52 美元的单次成本,差距很明显。开源模型组合能到 90.3%,也给了一条不绑死闭源模型的路。我会先打个折——这是他们自家发布的路由器,数据肯定挑好看的放,但逻辑本身对做模型调度和成本控制的人有参考价值。