# Reddit 实测 MiMo-V2.5-Pro：开源模型里跑桌游《血染钟楼》最稳的一个

> 原标题：MiMo-V2.5-Pro - the actual best open-weights model

- 来源：r/LocalLLaMA
- 发布时间：2026-05-01T12:34:18.000Z
- AX AI 日报：https://ai-daily.ax0x.ai/items/12762
- 原文：https://www.reddit.com/r/LocalLLaMA/comments/1t0s5t4/mimov25pro_the_actual_best_openweights_model/

## 摘要

Reddit 用户 cjami 拿小米的 MiMo-V2.5-Pro 在《血染钟楼》里做了自主对局测试。模型扮演好人阵营时胜率 88%，扮演坏人时胜率掉到 48%，说明它更擅长合作推理，搞欺骗和伪装还差点意思。每局平均输出 18.3 万 token，成本 0.99 美元，工具调用出错率只有 0.4%，这个错误率很低，说明模型能稳定按规则调用游戏功能。对...

## 推荐理由

这条帖子来自 Reddit 个人测试，不是官方模型发布，权威性要打个折。但 HKR 三项都站得住：有具名基准、有胜负率、有 token 消耗和成本对比，还有工具调用错误率，信息量够放进 featured 档。

## 锐评

这个测试挺有意思，不是跑分，而是让模型真的去玩一局《血染钟楼》。好人阵营88%的胜率说明 MiMo-V2.5-Pro 在需要合作推理、拼凑信息的场景里表现很稳。但坏人胜率掉到48%，基本跟瞎蒙差不多，说明它在伪装、误导、有策略地撒谎这些事上还不太行。

每局平均输出18.3万 token，成本0.99美元，工具调用出错率只有0.4%，这个错误率确实低，说明模型能老老实实按规则调用游戏功能，不会乱来。对比 Kimi K2.6 每局要跑58万 token、花2.65美元、一局拖10到15小时，MiMo 在效率和成本上优势明显。

不过要冷静一下：这只是一个用户在单一游戏里的测试，样本量、对局配置、对手策略都没披露。模型是不是真的“最强开源”，还得看更多场景和更多人的复现结果。另外，正文被 Reddit 屏蔽了，具体测试细节我没法核实，这点先打个折。
