jev-rerank-bench
anessbelbati
比较 Jev、专用 reranker 和聊天模型对同一批搜索片段的排序结果。
- 许可证
- MIT
- GitHub Stars
- 1
- 源码核查日期
- 2026-09-19
Jev 在哪一步做判断
用 Choice、Noul 和分档评分给候选片段排序,再计算检索指标。
这个项目的用途
提供原始响应、评分代码和分数据集结果,便于检查比较条件。
核查范围
作者报告的八个英文数据集等权 nDCG@10 为 Jev 0.692、Cohere 0.691,未证明明确胜出;按查询等权排名会变化。 已核对固定版本 README 与集成源码。
源码与说明
同类项目
jev-review
NiazMorshed2007 · 评测与观测
供编码 Agent 使用的本地 MCP 代码质量检查器,返回多个维度的结构化评分。
jev-benchmarks
AbdelStark · 评测与观测
把 Jev 和 GLiNER 放到同一批分类题上,除了答对率,也检查概率靠不靠谱。
jev-playground
mizchi · 评测与观测
MoonBit 与 TypeScript 的 Jev 实验集,覆盖棋类、浏览器、命令风险和小型语言。
jev-lm
y0usaf · 评测与观测
把下一个词当选择题,试着用 Jev 拼出句子;也能让它挑选本地草拟的整段续写。