Method Ranking Self-Consistency on Combined benchmark M=120 questions
0.8925Mean Kendall's Tau-bnanson_rank_ties_average
Evaluation Results
| Method | Links | ||
|---|---|---|---|
| nanson_rank_ties_averageSub-sampling budget=N=1, Reference=method@80 ranking, Trials=802026.03 | 0.8925 | 0.0497 | |
| rasch_mml_credibleSub-sampling budget=N=1, Reference=method@80 ranking, Trials=802026.03 | 0.8831 | 0.037 | |
| nanson_rank_ties_maxSub-sampling budget=N=1, Reference=method@80 ranking, Trials=802026.03 | 0.8669 | 0.0589 | |
| baldwin_rank_ties_averageSub-sampling budget=N=1, Reference=method@80 ranking, Trials=802026.03 | 0.8664 | 0.0492 | |
| copelandSub-sampling budget=N=1, Reference=method@80 ranking, Trials=802026.03 | 0.8654 | 0.0489 | |
| ranked_pairs_strength_margin_tie_halfSub-sampling budget=N=1, Reference=method@80 ranking, Trials=802026.03 | 0.8654 | 0.0489 | |
| ranked_pairs_strength_margin_tie_ignoreSub-sampling budget=N=1, Reference=method@80 ranking, Trials=802026.03 | 0.8654 | 0.0489 | |
| ranked_pairs_strength_winning_votes_tie_halfSub-sampling budget=N=1, Reference=method@80 ranking, Trials=802026.03 | 0.8654 | 0.0489 | |
| ranked_pairs_strength_winning_votes_tie_ignoreSub-sampling budget=N=1, Reference=method@80 ranking, Trials=802026.03 | 0.8654 | 0.0489 | |
| schulze_tie_halfSub-sampling budget=N=1, Reference=method@80 ranking, Trials=802026.03 | 0.8654 | 0.0489 | |
| schulze_tie_ignoreSub-sampling budget=N=1, Reference=method@80 ranking, Trials=802026.03 | 0.8654 | 0.0489 | |
| rasch_mmlSub-sampling budget=N=1, Reference=method@80 ranking, Trials=802026.03 | 0.8648 | 0.0417 | |
| bayesSub-sampling budget=N=1, Reference=method@80 ranking, Trials=802026.03 | 0.8647 | 0.0486 | |
| bayes_ciSub-sampling budget=N=1, Reference=method@80 ranking, Trials=802026.03 | 0.8647 | 0.0486 | |
| avgSub-sampling budget=N=1, Reference=method@80 ranking, Trials=802026.03 | 0.8647 | 0.0486 | |
| nash_advantage_vs_equilibriumSub-sampling budget=N=1, Reference=method@80 ranking, Trials=802026.03 | 0.8647 | 0.0486 | |
| nash_vs_equilibriumSub-sampling budget=N=1, Reference=method@80 ranking, Trials=802026.03 | 0.8647 | 0.0486 | |
| pagerankSub-sampling budget=N=1, Reference=method@80 ranking, Trials=802026.03 | 0.8647 | 0.0486 | |
| rank_centrality_tie_halfSub-sampling budget=N=1, Reference=method@80 ranking, Trials=802026.03 | 0.8647 | 0.0486 | |
| spectralSub-sampling budget=N=1, Reference=method@80 ranking, Trials=802026.03 | 0.8647 | 0.0486 | |
| alpharankSub-sampling budget=N=1, Reference=method@80 ranking, Trials=802026.03 | 0.8646 | 0.0486 | |
| bordaSub-sampling budget=N=1, Reference=method@80 ranking, Trials=802026.03 | 0.8646 | 0.0499 | |
| hodge_rank_binary_uniformSub-sampling budget=N=1, Reference=method@80 ranking, Trials=802026.03 | 0.8623 | 0.0491 | |
| elo_tie_correct_draw_onlySub-sampling budget=N=1, Reference=method@80 ranking, Trials=802026.03 | 0.8074 | 0.0507 | |
| bayes_greedySub-sampling budget=N=1, Reference=method@80 ranking, Trials=802026.03 | 0.8064 | 0.0309 | |
| elo_tie_drawSub-sampling budget=N=1, Reference=method@80 ranking, Trials=802026.03 | 0.8063 | 0.0507 | |
| minimax_variant_margin_tie_halfSub-sampling budget=N=1, Reference=method@80 ranking, Trials=802026.03 | 0.7963 | 0.0454 | |
| minimax_variant_margin_tie_ignoreSub-sampling budget=N=1, Reference=method@80 ranking, Trials=802026.03 | 0.7963 | 0.0454 | |
| minimax_variant_winning_votes_tie_halfSub-sampling budget=N=1, Reference=method@80 ranking, Trials=802026.03 | 0.7963 | 0.0454 | |
| minimax_variant_winning_votes_tie_ignoreSub-sampling budget=N=1, Reference=method@80 ranking, Trials=802026.03 | 0.7655 | 0.0455 |