Instruction-guided image editing preference prediction on AURORA-Bench
63.62AccuracyEDITREWARD
Evaluation Results
| Method | Links | |
|---|---|---|
| EDITREWARDBackbone=MiMo-VL-7B-SFT2025.09 | 63.62 | |
| EDITREWARDBackbone=Qwen2.5-VL-7B2025.09 | 59.5 | |
| ADIEEMethod Category=Open-Source VLMs2025.09 | 55.56 | |
| GPT-4oMethod Category=Proprietary Models2025.09 | 50.81 | |
| Gemini-2.5-FlashMethod Category=Proprietary Models2025.09 | 47.63 | |
| GPT-5Method Category=Proprietary Models2025.09 | 47.27 | |
| Gemini-2.0-FlashMethod Category=Proprietary Models2025.09 | 44.31 | |
| Qwen2.5-VL-7B-InstMethod Category=Open-Source VLMs2025.09 | 38.62 | |
| Qwen2.5-VL-32B-InstMethod Category=Open-Source VLMs2025.09 | 37.06 | |
| RandomMethod Category=Baseline2025.09 | 33.43 | |
| Qwen2.5-VL-3B-InstMethod Category=Open-Source VLMs2025.09 | 30.69 | |
| MiMo-VL-7B-SFT-2508Method Category=Open-Source VLMs2025.09 | 30.43 |