jevbench
fstandhartinger
该仓库提供 JevBench 基准,向 Jev 类决策模型输入状态和有界评分规则,并对返回的类型化答案按 Intelligence、Calibration、Speed 和 Cost 四个维度计分。
- 许可证
- MIT
- GitHub Stars
- 23
- 源码核查日期
- —
Jev 在哪一步做判断
Jev 根据输入的 state 和有界 rubric,对 noul/choice/score 三类问题返回类型化答案及每个选项的概率分布。
这个项目的用途
把选择和打分接进现有程序;暂无可核验的性能对照。
核查范围
根据仓库简介与 README 自动提炼;决策机制为规则归类,待人工复核,未独立测试性能。
源码与说明
同类项目
jev
dannote · SDK 与决策框架
把 Jev 接成 Elixir/OTP 异步进程,在 GenServer 中用模式匹配处理返回结果。
zod-jev
jomatsu · SDK 与决策框架
为 Zod 校验增加语义规则,例如描述是否匹配或文本是否包含个人信息。
daf-jev
docxology · SDK 与决策框架
把 Jev 常用零件装成一个 Python 工具箱:提问、批量跑样本、看校准情况,再把结果接到程序或 MCP。
jev-starter
hamakyo · SDK 与决策框架
在 TypeSafe SDK 上补充决策阈值、备用路径、人工复核和评测模式的 TypeScript 工具集。