jev-benchmarks
AbdelStark
文章分類・確率校正・選択的自動化を Jev と GLiNER で比較するベンチマーク。
- ライセンス
- Apache-2.0
- GitHub Stars
- 9
- ソース確認日
- 2026-09-19
Jev が判断する箇所
同じラベル付き課題を実行し、確率・遅延・失敗を記録する。
このプロジェクトの用途
課題ごとの精度と、閾値に使う確率の妥当性を調べられる。
確認の範囲
固定バージョンの文書とソースを確認。実行・性能・安全性は当サイトで独立検証していません。
ソースと実装
同じカテゴリのプロジェクト
jev-review
NiazMorshed2007 · 評価・可観測性
コーディング Agent に複数の品質スコアを返すローカル MCP レビューサーバー。
jev-playground
mizchi · 評価・可観測性
ゲーム・ブラウザー・コマンドリスク・小型言語を扱う MoonBit / TypeScript の Jev 実験集。
jev-lm
y0usaf · 評価・可観測性
Jev に単語を選ばせ、ローカルで作った続きの文章を検証する生成実験。
jev-chat
adhyaay-karnwal · 評価・可観測性
Jev に単語や句を繰り返し選ばせ、コードで回答を組み立てる研究用デコーダー。