Preference Alignment on Avg.
70.6GRACW-DPO
Evaluation Results
| Method | Links | |
|---|---|---|
| CW-DPOWeak-to-Strong Model Pair=Qwen2.5-0.5B → Qwen2.5-7B2026.03 | 70.6 | |
| CW-DPOWeak-to-Strong Model Pair=OPT-125M → OPT-1.3B2026.03 | 68.8 | |
| Human (100%)Weak-to-Strong Model Pair=OPT-125M → OPT-1.3B2026.03 | 66.4 | |
| Human (100%)Weak-to-Strong Model Pair=Qwen2.5-0.5B → Qwen2.5-7B2026.03 | 65.1 |