jev-benchmark
wondertwins
通过国际象棋和游戏 NPC 对话对象识别,测试 Jev 的选择与判断边界。
- 许可证
- MIT
- GitHub Stars
- 2
- 源码核查日期
- 2026-09-19
Jev 在哪一步做判断
在合法棋步中选择,或分别判断玩家话语是否在对某个 NPC 说。
这个项目的用途
公开标注数据、原始请求响应与评测代码。
核查范围
棋力、F1、时延均来自作者特定数据与设置,不能推广为通用游戏能力。 已核对固定版本 README 与集成源码。
源码与说明
同类项目
jev-review
NiazMorshed2007 · 评测与观测
供编码 Agent 使用的本地 MCP 代码质量检查器,返回多个维度的结构化评分。
jev-benchmarks
AbdelStark · 评测与观测
把 Jev 和 GLiNER 放到同一批分类题上,除了答对率,也检查概率靠不靠谱。
jev-playground
mizchi · 评测与观测
MoonBit 与 TypeScript 的 Jev 实验集,覆盖棋类、浏览器、命令风险和小型语言。
jev-lm
y0usaf · 评测与观测
把下一个词当选择题,试着用 Jev 拼出句子;也能让它挑选本地草拟的整段续写。