Hacker News · AI· felix089·· 23 小时前AI 评分47
Show HN:Jevman 开源基准测试 AI 模型玩吃豆人
Show HN: Jevman – AI decision models play Pac-Man
AI 导读
Jevman 是一个开源基准测试,让 AI 模型通过 HTTP 端点与经典幽灵对战吃豆人游戏。每个模型需进行 100 局游戏,每步决策限时 2 秒,超时则触发备用规则。该工具支持托管模型、微调模型及本地运行模型参与排名,所有对局均可复现验证。
来源:Hacker News · AI · opper.ai