# Show HN: Jevman —— AI 决策模型玩 Pac-Man 的基准测试

> 原标题：Show HN: Jevman – AI decision models play Pac-Man

- 来源：Hacker News 首页
- 发布时间：2026-10-08T16:34:13.000Z
- AX AI 日报：https://ai-daily.ax0x.ai/items/ne1tn4gudmurm5sj4yo51gwsf
- 原文：https://opper.ai/jevman-benchmark/

## 摘要

Jevman 让 AI 决策模型在经典吃豆人游戏中与街机幽灵对战，每个模型各跑 100 局并按平均分排名，分数在 95% 误差范围内视为并列。该基准开源，任何部署在 HTTP 端点后的模型（托管模型、微调模型或本地模型）都可接入：游戏在每个路口以 JSON 发送迷宫状态并请求方向，模型返回各方向概率，超时 2 秒则由备用规则接管。提交结果经 CI 回放校验后以自报成绩加入排行榜。
