Sentiment Classification on CR (test)
92.7Mean AccuracyUniFew_meta
Evaluation Results
| Method | Links | |
|---|---|---|
| UniFew_metaShots=16/162021.07 | 92.7 | |
| UniFewShots=16/162021.07 | 92.2 | |
| UniFew_metaShots=02021.07 | 92.1 | |
| P-TuningBackbone=RoBERTa-large, Training Samples (K)=16, Evaluation Protocol=Few-shot fine-tuning2021.08 | 91.8 | |
| DARTBackbone=RoBERTa-large, Training Samples (K)=16, Evaluation Protocol=Few-shot fine-tuning2021.08 | 91.8 | |
| Z-ICLModel=GPT-NeoX, Prompting=Direct, Training data access=false2022.12 | 91.4 | |
| LM-BFFShots=16/162021.07 | 91 | |
| Fine-tuning (full)Backbone=RoBERTa-large, Training Samples (K)=full, Evaluation Protocol=Full fine-tuning2021.08 | 89.4 | |
| LM-BFFBackbone=RoBERTa-large, Training Samples (K)=16, Evaluation Protocol=Few-shot fine-tuning2021.08 | 89 | |
| RETROPROMPTShot=16-shot, Source Domain=MR2022.05 | 88.8 | |
| RETROPROMPTshot=16-shot, source_dataset=MR, domain_role=Target Domain2025.12 | 88.8 | |
| LM-BFF (D-demo)Shot=16-shot, Source Domain=MR2022.05 | 87.5 | |
| LM-BFF (D-demo)shot=16-shot, source_dataset=MR, domain_role=Target Domain2025.12 | 87.5 | |
| GPT-3 in-context learningBackbone=RoBERTa-large, Training Samples (K)=16, Evaluation Protocol=In-context learning2021.08 | 87.4 | |
| LM-BFF (man)Shot=16-shot, Source Domain=MR2022.05 | 86.9 | |
| LM-BFF (man)shot=16-shot, source_dataset=MR, domain_role=Target Domain2025.12 | 86.9 | |
| KPTShot=16-shot, Source Domain=MR2022.05 | 86.7 | |
| KPTshot=16-shot, source_dataset=MR, domain_role=Target Domain2025.12 | 86.7 | |
| ICL-goldModel=GPT-NeoX, Prompting=Channel, Training data access=true2022.12 | 85.5 | |
| ICL-goldModel=GPT-J, Prompting=Channel, Training data access=true2022.12 | 84.4 | |
| ICL-randomModel=GPT-J, Prompting=Channel, Training data access=true2022.12 | 82.3 | |
| ICL-randomPrompting Method=Direct, Backbone=GPT-3, Oracle=true2022.12 | 81 | |
| Z-ICLPrompting Method=Channel, Backbone=GPT-32022.12 | 80.8 | |
| Z-ICLModel=GPT-J, Prompting=Channel, Training data access=false2022.12 | 80.1 | |
| LM-BFF_manShots=02021.07 | 79.5 | |
| Prompt-based zero-shotBackbone=RoBERTa-large, Training Samples (K)=0, Evaluation Protocol=Zero-shot2021.08 | 79.5 | |
| ICL-goldPrompting Method=Direct, Backbone=GPT-3, Oracle=true2022.12 | 79.5 | |
| ICL-randomModel=GPT-J, Prompting=Direct, Training data access=true2022.12 | 79.1 | |
| Z-ICLModel=GPT-NeoX, Prompting=Channel, Training data access=false2022.12 | 79 | |
| UniFewShots=02021.07 | 78.8 | |
| Z-ICLModel=GPT-J, Prompting=Direct, Training data access=false2022.12 | 78.8 | |
| ICL-goldModel=GPT-NeoX, Prompting=Direct, Training data access=true2022.12 | 78.5 | |
| ICL-randomModel=GPT-NeoX, Prompting=Direct, Training data access=true2022.12 | 78.5 | |
| ICL-randomModel=GPT-NeoX, Prompting=Channel, Training data access=true2022.12 | 78.1 | |
| Random inputsModel=GPT-J, Prompting=Channel, Training data access=false2022.12 | 77.8 | |
| No-demosPrompting Method=Channel, Backbone=GPT-32022.12 | 76.6 | |
| Naive Z-ICLModel=GPT-NeoX, Prompting=Direct, Training data access=false2022.12 | 76.2 | |
| Fine-tuningBackbone=RoBERTa-large, Training Samples (K)=16, Evaluation Protocol=Few-shot fine-tuning2021.08 | 75.8 | |
| ICL-goldPrompting Method=Channel, Backbone=GPT-3, Oracle=true2022.12 | 74.2 | |
| ICL-randomPrompting Method=Channel, Backbone=GPT-3, Oracle=true2022.12 | 73.9 | |
| No-demosModel=GPT-J, Prompting=Channel, Training data access=false2022.12 | 73.2 | |
| Random inputsModel=GPT-NeoX, Prompting=Direct, Training data access=false2022.12 | 72.5 | |
| Z-ICLPrompting Method=Direct, Backbone=GPT-32022.12 | 71.9 | |
| Random inputsModel=GPT-J, Prompting=Direct, Training data access=false2022.12 | 71.1 | |
| ICL-goldModel=GPT-J, Prompting=Direct, Training data access=true2022.12 | 68.7 | |
| No-demosPrompting Method=Direct, Backbone=GPT-32022.12 | 68.4 | |
| Random inputsModel=GPT-NeoX, Prompting=Channel, Training data access=false2022.12 | 68 | |
| Naive Z-ICLModel=GPT-J, Prompting=Direct, Training data access=false2022.12 | 65.2 | |
| FTShot=16-shot, Source Domain=MR2022.05 | 64.7 | |
| FTshot=16-shot, source_dataset=MR, domain_role=Target Domain2025.12 | 64.7 | |
| Naive Z-ICLModel=GPT-NeoX, Prompting=Channel, Training data access=false2022.12 | 62.4 | |
| Naive Z-ICLModel=GPT-J, Prompting=Channel, Training data access=false2022.12 | 62.1 | |
| No-demosModel=GPT-NeoX, Prompting=Direct, Training data access=false2022.12 | 61.5 | |
| No-demosModel=GPT-NeoX, Prompting=Channel, Training data access=false2022.12 | 57.2 | |
| No-demosModel=GPT-J, Prompting=Direct, Training data access=false2022.12 | 50.6 | |
| MajorityBackbone=RoBERTa-large, Training Samples (K)=0, Evaluation Protocol=Majority class2021.08 | 50 | |
| Majority2022.12 | 50 | |
| MajorityTraining data access=false2022.12 | 50 |