Evidence Ranking on Evidence Ranking
0.75MRRGPT-4o (Incremental LLM)
Evaluation Results
| Method | Links | ||
|---|---|---|---|
| GPT-4o (Incremental LLM)Ranking Strategy=Incremental, Model=GPT-4o, Method Category=LLM2026.01 | 0.75 | 62.9 | |
| Qwen3-235B-A22B-Instruct (Incremental LLM)Ranking Strategy=Incremental, Model=Qwen3-235B-A22B-Instruct, Method Category=LLM2026.01 | 0.75 | 62.4 | |
| Qwen3-235B-A22B-Instruct (One-Shot LLM)Ranking Strategy=One-Shot, Model=Qwen3-235B-A22B-Instruct, Method Category=LLM2026.01 | 0.71 | 60 | |
| GPT-4o (One-Shot LLM)Ranking Strategy=One-Shot, Model=GPT-4o, Method Category=LLM2026.01 | 0.69 | 56.2 | |
| One-Shot Fine-tuned RerankerRanking Strategy=One-Shot, Method Category=Reranker, Model=ReasonRank-7B, Fine-tuned=true2026.01 | 0.67 | 55.1 | |
| Incremental SimilarityRanking Strategy=Incremental, Method Category=Similarity2026.01 | 0.49 | 33.5 | |
| One-Shot SimilarityRanking Strategy=One-Shot, Method Category=Similarity2026.01 | 0.47 | 32.4 | |
| One-Shot Fine-tuned NLIRanking Strategy=One-Shot, Method Category=NLI, Fine-tuned=true2026.01 | 0.31 | 22.5 |