OPEN-SOURCE PROJECT
jev-search-rerank-eval
Retrieval evaluation system measuring Jev reranking against lexical, embedding, and fusion baselines across 9,831 query-document pairs.
- Stars
- 4
- Forks
- 0
- License
- MIT
- Last commit
- 2026-09-18
What Jev does here
Invokes Jev judges to grade multi-level relevance on bilingual queries, evaluating ranking metrics and judge-circularity effects.
Provides rigorous empirical evidence comparing discrete judgment rerankers against vector search in multilingual discovery contexts.
Source code verified against pinned commit. Complete evaluation suite and CLI inspected; benchmarked on Agent Skills Hub data.