跳到正文
AI HOT 精选

OpenRouter 发布实时网页搜索基准:搜索预算比引擎和模型都重要

OpenRouter 推出实时网页搜索基准测试:如何为智能体选择引擎、深度与模型

OpenRouter 搞了个实时更新的排行榜,把 Exa、Parallel、Perplexity 和各家模型自带的搜索引擎,搭配不同模型和搜索轮数,跑了一遍 BrowseComp、DeepSearchQA 等四个测试。最核心的发现是:多给模型几次搜索机会,是提升回答质量最便宜的办法。比如 Claude Opus 5 用 Perplexity 搜 1 次...

推荐理由:OpenRouter 自己下场跑跨引擎对比,对实际干活的人有参考价值。最核心的发现——多搜几次比升级模型更划算——能直接指导选型。没给更高分是因为这是平台方自己出的基准,不是独立第三方评测,我会先打个折。

读原文 ↗导出 Markdown