Commonsense Reasoning on SWAG (test)
0.9412AccuracyTEAM
Evaluation Results
| Method | Links | |
|---|---|---|
| TEAMBackbone=DeBERTa Large2022.10 | 0.9412 | |
| UNICORN 11BModel=UNICORN 11B2022.10 | 0.939 | |
| XELECTRA-lModel Size=large2022.04 | 0.9283 | |
| ScoreBackbone=DeBERTa Large2022.10 | 0.9237 | |
| ALUMBackbone=ROBERTA-LARGE2020.04 | 0.91 | |
| ROBERTA_LARGE2020.04 | 0.899 | |
| TEAMBackbone=RoBERTa Large2022.10 | 0.8988 | |
| ScoreBackbone=RoBERTa Large2022.10 | 0.8897 | |
| XELECTRA-bModel Size=base2022.04 | 0.8891 | |
| Human2020.04 | 0.88 | |
| BERT_LARGE2020.04 | 0.863 | |
| XBERT-bModel Size=base2022.04 | 0.8134 | |
| GPT2020.04 | 0.78 |