Sentiment Steering on OpenWebText Neutral to Positive (test)
12.48Perplexity (PPL)GPT2-Large
Evaluation Results
| Method | Links | |||||||
|---|---|---|---|---|---|---|---|---|
| GPT2-LargeEvaluation Setting=Baseline, Backbone Model=GPT2-Large2025.03 | 12.48 | 53.55 | 52 | 82 | 85 | — | — | |
| LLMBRACESEvaluation Setting=Zero-shot, Rank (r)=162025.03 | 30.03 | 69.82 | 46 | 77 | 85 | — | — | |
| DAPT2021.05 | 30.52 | — | 56 | 83 | 84 | 77.24 | 14.17 | |
| DAPTbase_model=GPT-2 Large 774M2023.06 | 30.52 | — | — | 83 | 84 | 77.24 | 14.17 | |
| PromptT5Evaluation Setting=Zero-shot2025.03 | 37.3 | 68.12 | 58 | 78 | 72 | — | — | |
| LMSteerEvaluation Setting=Supervised2025.03 | 41.2 | 90.7 | 46 | 78 | 83 | — | — | |
| DEXPERTSModel size=small2021.05 | 42.08 | — | 56 | 83 | 84 | 94.57 | 31.64 | |
| DEXPERTSModel size=medium2021.05 | 43.19 | — | 56 | 83 | 83 | 94.31 | 33.2 | |
| CTRL2021.05 | 43.79 | — | 51 | 83 | 86 | 61.81 | 18.88 | |
| CTRLbase_model=GPT-2 Large 774M2023.06 | 43.79 | — | — | 83 | 86 | 61.82 | 18.88 | |
| DExpertsEvaluation Setting=Supervised2025.03 | 45.83 | 94.46 | 56 | 83 | 83 | — | — | |
| DEXPERTSModel size=large2021.05 | 45.83 | — | 56 | 83 | 83 | 94.46 | 36.42 | |
| DExpertsbase_model=GPT-2 Large 774M2023.06 | 45.83 | — | — | 83 | 83 | 94.46 | 36.42 | |
| DEXPERTSMode=anti-only2021.05 | 46 | — | 65 | 80 | 78 | 60.72 | 4.43 | |
| LLMBRACESEvaluation Setting=Supervised, Rank (r)=162025.03 | 52.63 | 91.2 | 38 | 73 | 81 | — | — | |
| CLICKbase_model=GPT-2 Large 774M2023.06 | 57.43 | — | — | 80 | 84 | 96.7 | 85.78 | |
| GeDiEvaluation Setting=Supervised2025.03 | 58.41 | 86.01 | 57 | 80 | 79 | — | — | |
| GeDi2021.05 | 58.41 | — | 57 | 80 | 79 | 86.01 | 26.8 | |
| GeDibase_model=GPT-2 Large 774M2023.06 | 58.41 | — | — | 80 | 79 | 86.01 | 26.8 | |
| Positive expert2021.05 | 64.32 | — | 59 | 86 | 85 | 79.83 | 43.8 | |
| Target FTbase_model=GPT-2 Large 774M2023.06 | 64.32 | — | — | 86 | 85 | 79.83 | 43.8 | |
| CLICKbase_model=GPT-2 Large 774M, variant=Lower2023.06 | 73.98 | — | — | 83 | 85 | 96.33 | 83.82 | |
| CLICKbase_model=GPT-2 Large 774M, variant=Random2023.06 | 82.24 | — | — | 85 | 86 | 96.51 | 84 | |
| CLICKbase_model=GPT-2 Large 774M, variant=Lowest2023.06 | 109.04 | — | — | 84 | 86 | 96.02 | 80.64 | |
| PPLMStep size=10%2021.05 | 142.11 | — | 62 | 86 | 85 | 52.68 | 8.72 | |
| PPLMbase_model=GPT-2 Large 774M2023.06 | 142.11 | — | — | 86 | 85 | 52.68 | 8.72 | |
| LoRAEvaluation Setting=Supervised2025.03 | 158.56 | 26.88 | 57 | 82 | 83 | — | — |