Natural Language Inference on RTE (val)
0.918AccuracyUnified PPT
Evaluation Results
| Method | Links | |||
|---|---|---|---|---|
| Unified PPTtuning_strategy=unified pre-trained prompt tuning2021.09 | 0.918 | — | — | |
| FTtuning_strategy=fine-tuning2021.09 | 0.898 | — | — | |
| PPTtuning_strategy=pre-trained prompt tuning2021.09 | 0.896 | — | — | |
| PTtuning_strategy=prompt-tuning2021.09 | 0.88 | — | — | |
| ENSBackbone=RoBERTa-base2024.06 | 0.7774 | 0.1947 | 1.04 | |
| MCDBackbone=RoBERTa-base2024.06 | 0.7665 | 0.1306 | 0.65 | |
| LAPBackbone=RoBERTa-base2024.06 | 0.7605 | 0.0533 | 0.55 | |
| BLoBBackbone=RoBERTa-base, N=02024.06 | 0.7605 | 0.1464 | 0.56 | |
| MLEBackbone=RoBERTa-base2024.06 | 0.7581 | 0.2059 | 1.11 | |
| MAPBackbone=RoBERTa-base2024.06 | 0.7581 | 0.2167 | 1.23 | |
| BLoBBackbone=RoBERTa-base, N=102024.06 | 0.7545 | 0.0897 | 0.48 | |
| BLoBBackbone=RoBERTa-base, N=52024.06 | 0.7461 | 0.1046 | 0.5 | |
| ZeroGenPLM=GPT2-XL, TAM=DistilBERT, Setting=ZEROGEN, #Param=66M2022.02 | 0.5993 | — | — | |
| ZeroGenPLM=GPT2-XL, TAM=LSTM, Setting=ZEROGEN, #Param=~7M2022.02 | 0.5885 | — | — | |
| ZeroGenPLM=GPT2-Large, TAM=DistilBERT, Setting=ZEROGEN, #Param=66M2022.02 | 0.5848 | — | — | |
| DistilBERTPLM=Gold Data, Setting=SUPERVISED, #Param=66M2022.02 | 0.5812 | — | — | |
| GPT2-XLSetting=PROMPTING, #Param=1.5B2022.02 | 0.5704 | — | — | |
| ZeroGenPLM=GPT2-Large, TAM=LSTM, Setting=ZEROGEN, #Param=~7M2022.02 | 0.5668 | — | — | |
| LSTMPLM=Gold Data, Setting=SUPERVISED, #Param=~7M2022.02 | 0.5487 | — | — | |
| GPT2-LargeSetting=PROMPTING, #Param=762M2022.02 | 0.5451 | — | — | |
| GPT2Setting=PROMPTING, #Param=117M2022.02 | 0.527 | — | — | |
| ZeroGenPLM=GPT2, TAM=DistilBERT, Setting=ZEROGEN, #Param=66M2022.02 | 0.5054 | — | — | |
| BBBBackbone=RoBERTa-base2024.06 | 0.4946 | 0.0266 | 0.69 | |
| ZeroGenPLM=GPT2, TAM=LSTM, Setting=ZEROGEN, #Param=~7M2022.02 | 0.491 | — | — |