OPEN-SOURCE PROJECT

jev-search-rerank-eval

Retrieval evaluation system measuring Jev reranking against lexical, embedding, and fusion baselines across 9,831 query-document pairs.

Stars
4
Forks
0
License
MIT
Last commit
2026-09-18

What Jev does here

Invokes Jev judges to grade multi-level relevance on bilingual queries, evaluating ranking metrics and judge-circularity effects.

Provides rigorous empirical evidence comparing discrete judgment rerankers against vector search in multilingual discovery contexts.

Source code verified against pinned commit. Complete evaluation suite and CLI inspected; benchmarked on Agent Skills Hub data.