jev-rerank-bench
anessbelbati/jev-rerank-bench
Can a decision model beat dedicated rerankers? TypeSafe Jev vs Cohere Rerank 4 vs ZeroEntropy zerank-2 vs a chat-model baseline: 14 datasets, every raw API response, bootstrap ranges on every gap.
研究と評価Python
- スター
- 7
- フォーク
- 0
トピック
jevpython