Language Model Robustness on LMentry
52.2LMentry ScoreFLAN-T5
Evaluation Results
| Method | Links | |
|---|---|---|
| FLAN-T5#Examples=14,336,000, Evaluation Protocol=Prior Work2022.12 | 52.2 | |
| T5-LM on Unnatural Instructions + Instruction Paraphrases#Examples=240,670, Evaluation Protocol=Our Approach2022.12 | 50.7 | |
| T5-LM on Unnatural Instructions#Examples=64,000, Evaluation Protocol=Our Approach2022.12 | 42 | |
| T0++#Examples=12,492,800, Evaluation Protocol=Prior Work2022.12 | 38.3 | |
| Tk-Instruct#Examples=75,417, Evaluation Protocol=Prior Work2022.12 | 35.7 | |
| T5-LM on Super-Natural Instructions#Examples=64,000, Evaluation Protocol=Direct Comparison Baseline2022.12 | 34.6 | |
| T5-LM#Examples=0, Evaluation Protocol=Prior Work2022.12 | 20.6 |