跳到正文
AI HOT 精选

OpenRouter 让 11 款大模型打了一局 30 轮吃鸡,Grok 赢麻了,Claude 在交朋友

OpenRouter 翻遍 11 款 LLM 找最快的决策模型:Claude vs. Grok 领衔

OpenRouter 花了 482 美元推理费,把 11 个模型扔进一个 2D 大逃杀游戏里打了 30 局。Grok 4.1 Fast 赢了 13 局,每赢一局成本只要 0.97 美元;而 Claude Sonnet 4.6 赢了 5 局,每局成本 26.78 美元,贵了 27 倍。最会杀敌的是 GPT 5.4,干掉了 38 个对手,但只赢了 2 局,...

推荐理由:OpenRouter 自己搞的测试,不是模型官方发布或标准基准,我会先打个折。但实验条件写得清楚,482 美元、30 轮实时决策,Claude 和 Grok 在速度和成功率上领跑,这个结论对正在挑决策模型的人有用。正文没披露具体延迟数字和成功率差异有多大,这点先别太激动。

读原文 ↗导出 Markdown