Semantic Equivalence on MRPC (Success rate)
70Success RateTextGrad
Evaluation Results
| Method | Links | |
|---|---|---|
| TextGradPrompt Optimizer=TextGrad (Gradient-based), Evaluation Model=GPT-4o-mini2026.01 | 70 | |
| Dream-7BPrompt Optimizer=Dream-7B (DLM), Evaluation Model=GPT-4o-mini2026.01 | 69 | |
| Llama3-8BPrompt Optimizer=Llama3-8B (AR), Evaluation Model=GPT-4o-mini2026.01 | 69 | |
| Qwen3-8BPrompt Optimizer=Qwen3-8B (AR), Evaluation Model=GPT-4o-mini2026.01 | 69 | |
| BaselineDescription=Original prompts, Evaluation Model=GPT-4o-mini2026.01 | 61 |