Sentiment Classification on SST
88.19AccuracySCD-RoBERTa_base
Evaluation Results
| Method | Links | |
|---|---|---|
| SCD-RoBERTa_baseBackbone=RoBERTa-base2022.03 | 88.19 | |
| SimCSE-RoBERTa_baseBackbone=RoBERTa-base2022.03 | 87.26 | |
| USE_T+CNN (lrn w.e.)Universal Encoder=Transformer (USE_T), Transfer Level=Sentence, Embedding Initialization=learned on transfer task, Transfer Task Model=CNN2018.03 | 87.21 | |
| RoBERTa [CLS]-embeddingBackbone=RoBERTa-base, Pooling=CLS2022.03 | 86.71 | |
| USE_T+CNN (w2v w.e.)Universal Encoder=Transformer (USE_T), Transfer Level=Sentence & Word, Embedding Initialization=word2vec skip-gram, Transfer Task Model=CNN2018.03 | 86.69 | |
| USE_T+DAN (w2v w.e.)Universal Encoder=Transformer (USE_T), Transfer Level=Sentence & Word, Embedding Initialization=word2vec skip-gram, Transfer Task Model=DAN2018.03 | 86.62 | |
| BERT [CLS]-embeddingBackbone=BERT-base, Pooling=CLS2022.03 | 86.49 | |
| USE_T+DAN (lrn w.e.)Universal Encoder=Transformer (USE_T), Transfer Level=Sentence, Embedding Initialization=learned on transfer task, Transfer Task Model=DAN2018.03 | 86.24 | |
| IS-BERT_baseBackbone=BERT-base2022.03 | 85.96 | |
| SCD-BERT_baseBackbone=BERT-base2022.03 | 85.89 | |
| USE TUniversal Encoder=Transformer (USE_T), Transfer Level=Sentence, Embedding Initialization=None, Transfer Task Model=None2018.03 | 85.38 | |
| USE_D+CNN (w2v w.e.)Universal Encoder=Deep Averaging Network (USE_D), Transfer Level=Sentence & Word, Embedding Initialization=word2vec skip-gram, Transfer Task Model=CNN2018.03 | 85.29 | |
| USE_D+CNN (lrn w.e.)Universal Encoder=Deep Averaging Network (USE_D), Transfer Level=Sentence, Embedding Initialization=learned on transfer task, Transfer Task Model=CNN2018.03 | 85.27 | |
| CNN (lrn w.e.)Transfer Level=None, Embedding Initialization=learned on transfer task, Transfer Task Model=CNN2018.03 | 84.9 | |
| SimCSE-BERT_baseBackbone=BERT-base2022.03 | 84.57 | |
| Avg. BERT embeddingsBackbone=BERT-base, Pooling=Avg2022.03 | 84.4 | |
| CNN (w2v w.e.)Transfer Level=Word, Embedding Initialization=word2vec skip-gram, Transfer Task Model=CNN2018.03 | 83.74 | |
| USE_D+DAN (lrn w.e.)Universal Encoder=Deep Averaging Network (USE_D), Transfer Level=Sentence, Embedding Initialization=learned on transfer task, Transfer Task Model=DAN2018.03 | 83.41 | |
| USE_D+DAN (w2v w.e.)Universal Encoder=Deep Averaging Network (USE_D), Transfer Level=Sentence & Word, Embedding Initialization=word2vec skip-gram, Transfer Task Model=DAN2018.03 | 82.14 | |
| Skip-thoughtModel=Skip-thought2022.03 | 82 | |
| DAN (lrn w.e.)Transfer Level=None, Embedding Initialization=learned on transfer task, Transfer Task Model=DAN2018.03 | 81.52 | |
| DAN (w2v w.e.)Transfer Level=Word, Embedding Initialization=word2vec skip-gram, Transfer Task Model=DAN2018.03 | 80.24 | |
| GloVe embeddings (avg.)Model=GloVe (avg.)2022.03 | 80.18 | |
| USE DUniversal Encoder=Deep Averaging Network (USE_D), Transfer Level=Sentence, Embedding Initialization=None, Transfer Task Model=None2018.03 | 77.62 |