Sentiment Analysis on SST-2 (Success rate)
97Success RateDream-7B
Evaluation Results
| Method | Links | |
|---|---|---|
| Dream-7BPrompt Optimizer=Dream-7B (DLM), Evaluation Model=GPT-4o-mini2026.01 | 97 | |
| TextGradPrompt Optimizer=TextGrad (Gradient-based), Evaluation Model=GPT-4o-mini2026.01 | 97 | |
| Llama3-8BPrompt Optimizer=Llama3-8B (AR), Evaluation Model=GPT-4o-mini2026.01 | 96 | |
| Qwen3-8BPrompt Optimizer=Qwen3-8B (AR), Evaluation Model=GPT-4o-mini2026.01 | 96 | |
| BaselineDescription=Original prompts, Evaluation Model=GPT-4o-mini2026.01 | 93 |