Commonsense Reasoning on SWAG (dev)
91.2AccuracyALUM
Evaluation Results
| Method | Links | |
|---|---|---|
| ALUMBackbone=ROBERTA-LARGE, Fine-tuning=SMART2020.04 | 91.2 | |
| ALUMBackbone=ROBERTA-LARGE2020.04 | 90.7 | |
| Human2020.04 | 88 | |
| RoBERTa-SE_largeBackbone=RoBERTa, Model Scale=Large, Training Strategy=Self-Evolution (SE)2023.05 | 84.54 | |
| RoBERTa_largeBackbone=RoBERTa, Model Scale=Large, Training Strategy=Vanilla MLM2023.05 | 84.34 | |
| BERT-SE_largeBackbone=BERT, Model Scale=Large, Training Strategy=Self-Evolution (SE)2023.05 | 83.61 | |
| BERT_largeBackbone=BERT, Model Scale=Large, Training Strategy=Vanilla MLM2023.05 | 83.4 | |
| RoBERTa-SE_baseBackbone=RoBERTa, Model Scale=Base, Training Strategy=Self-Evolution (SE)2023.05 | 79.88 | |
| RoBERTa_baseBackbone=RoBERTa, Model Scale=Base, Training Strategy=Vanilla MLM2023.05 | 79.69 | |
| BERT-SE_baseBackbone=BERT, Model Scale=Base, Training Strategy=Self-Evolution (SE)2023.05 | 77.91 | |
| BERT_baseBackbone=BERT, Model Scale=Base, Training Strategy=Vanilla MLM2023.05 | 77.53 |