Awesome Jev

Index / anessbelbati/jev-rerank-bench

jev-rerank-bench

Can a decision model beat dedicated rerankers? TypeSafe Jev vs Cohere Rerank 4 vs ZeroEntropy zerank-2 vs a chat-model baseline: 14 datasets, every raw API response, bootstrap ranges on every gap.

Research and EvalsRankingPythonListed

Repository

Stars1
LanguagePython
LicenseMIT
Created2026-09-16
Last pushed2026-09-17
Officialno

Judgment

Genuine Jev project0.98
Uses Jev at runtime0.91
Is a meta list0.03
Is a reimplementation0.05

Quality scales

Substance1.69 / 3
Docs2.51 / 3
Novelty2.77 / 3
Composite score0.75

Category distribution

Research and Evals1.00
Integrations0.00
Other0.00
Agent and Dev Tooling0.00
Applications0.00
Learning0.00
SDKs and Clients0.00
Games and Simulation0.00
Assigned categoryResearch and Evals
Category probability1.00
Category confidence1.00
PatternRanking
Pattern confidence1.00

Curation

StatusListed
Reasongate passed
README pickno
Overridenone

Sources

Provenance

Modeljev-1.13.0
Question setv2
Judged at2026-09-17 16:33 UTC