Semantic Textual Similarity on STS Benchmark (test)
0.919Pearson Correlation (r)Prompt-based FT (hard) + PCP
Evaluation Results
| Method | Links | |
|---|---|---|
| Prompt-based FT (hard) + PCPBackbone=RoBERTa-LARGE, Supervision Setting=Full, Evaluation Protocol=Prompt-based Fine-tuning (hard), Continued Pre-training=PCP2023.05 | 0.919 | |
| ECNU2018.04 | 0.81 | |
| BIT2018.04 | 0.809 | |
| Reddit+SNLIFine-tuned on STS=true2018.04 | 0.808 | |
| CNN (HCTI)2018.04 | 0.784 | |
| Reddit+SNLIFine-tuned on STS=false2018.04 | 0.782 | |
| USE TUniversal Encoder=Transformer (USE_T), Transfer Level=Sentence, Embedding Initialization=None, Transfer Task Model=None2018.03 | 0.782 | |
| RedditFine-tuned on STS=true2018.04 | 0.781 | |
| InferSent2018.04 | 0.758 | |
| Sent2Vec2018.04 | 0.755 | |
| RedditFine-tuned on STS=false2018.04 | 0.731 | |
| SIF2018.04 | 0.72 | |
| USE DUniversal Encoder=Deep Averaging Network (USE_D), Transfer Level=Sentence, Embedding Initialization=None, Transfer Task Model=None2018.03 | 0.719 | |
| Prompt-based FT (hard) + PCPBackbone=RoBERTa-LARGE, Supervision Setting=Semi-supervised (16-shot), Evaluation Protocol=Prompt-based Fine-tuning (hard), Continued Pre-training=PCP2023.05 | 0.715 | |
| PV-DBOW2018.04 | 0.649 | |
| C-PHRASE2018.04 | 0.639 | |
| Cayley-EncoderBase Model=Llama3-8B, GNN Variant=GIN2026.03 | 0.6305 | |
| FC-EncoderBase Model=Gemma2-2B, GNN Variant=GCN2026.03 | 0.6286 | |
| Cayley-EncoderBase Model=Gemma2-2B, GNN Variant=GIN2026.03 | 0.6162 | |
| FC-EncoderBase Model=Llama3-8B, GNN Variant=GCN2026.03 | 0.5933 | |
| Best-LayerBase Model=Llama3-8B2026.03 | 0.5651 | |
| Cayley-EncoderBase Model=Pythia-410m, GNN Variant=GIN2026.03 | 0.5584 | |
| Cayley-EncoderBase Model=Gemma2-2B, GNN Variant=GCN2026.03 | 0.5553 | |
| FC-EncoderBase Model=Gemma2-2B, GNN Variant=GIN2026.03 | 0.5529 | |
| FC-EncoderBase Model=Pythia-410m, GNN Variant=GCN2026.03 | 0.542 | |
| Best-LayerBase Model=Pythia-410m2026.03 | 0.5353 | |
| DWAttBase Model=Gemma2-2B2026.03 | 0.5337 | |
| Best-LayerBase Model=Gemma2-2B2026.03 | 0.5297 | |
| DWAttBase Model=Llama3-8B2026.03 | 0.5285 | |
| FC-EncoderBase Model=Llama3-8B, GNN Variant=GIN2026.03 | 0.5087 | |
| Cayley-EncoderBase Model=Pythia-410m, GNN Variant=GCN2026.03 | 0.4953 | |
| DWAttBase Model=Pythia-410m2026.03 | 0.494 | |
| MLP Last-LayerBase Model=Llama3-8B2026.03 | 0.4891 | |
| WeightedBase Model=Llama3-8B2026.03 | 0.4577 | |
| Last-LayerBase Model=Llama3-8B2026.03 | 0.4563 | |
| FC-EncoderBase Model=Pythia-410m, GNN Variant=GIN2026.03 | 0.4329 | |
| Set-EncoderBase Model=Llama3-8B2026.03 | 0.4231 | |
| WeightedBase Model=Pythia-410m2026.03 | 0.4181 | |
| Cayley-EncoderBase Model=Llama3-8B, GNN Variant=GCN2026.03 | 0.4171 | |
| MLP Last-LayerBase Model=Gemma2-2B2026.03 | 0.4072 | |
| WeightedBase Model=Gemma2-2B2026.03 | 0.4052 | |
| Set-EncoderBase Model=Pythia-410m2026.03 | 0.3948 | |
| Last-LayerBase Model=Pythia-410m2026.03 | 0.3912 | |
| Last-LayerBase Model=Gemma2-2B2026.03 | 0.3682 | |
| Set-EncoderBase Model=Gemma2-2B2026.03 | 0.3667 | |
| MLP Last-LayerBase Model=Pythia-410m2026.03 | 0.2554 |