Multimodal Capability Evaluation on MM-Star
60.6Average ScoreQwen2.5-VL-7B
Evaluation Results
| Method | Links | |
|---|---|---|
| Qwen2.5-VL-7BBackbone=Qwen2.5-VL-7B2026.03 | 60.6 | |
| Qwen2.5-VL-7B + SFTBackbone=Qwen2.5-VL-7B2026.03 | 60.4 | |
| Qwen2.5-VL-7B + SFT+DPO+GRPOBackbone=Qwen2.5-VL-7B2026.03 | 60.27 | |
| Qwen2.5-VL-7B + SFT+DPOBackbone=Qwen2.5-VL-7B2026.03 | 59.73 | |
| Qwen2.5-VL-7B + SFT+GRPOBackbone=Qwen2.5-VL-7B2026.03 | 59.33 | |
| Qwen2.5-VL-7B + SPA-VLBackbone=Qwen2.5-VL-7B2026.03 | 59.13 | |
| Qwen2.5-VL-7B + SaFeR-VLMBackbone=Qwen2.5-VL-7B2026.03 | 58.87 | |
| Qwen2.5-VL-3B + VLGuardBackbone=Qwen2.5-VL-3B2026.03 | 52.67 | |
| Qwen2.5-VL-7B + TISBackbone=Qwen2.5-VL-7B2026.03 | 52.4 | |
| LLaVA-NeXTSize=34B, Feedback=X2024.05 | 51.6 | |
| Qwen2.5-VL-3B + SFTBackbone=Qwen2.5-VL-3B2026.03 | 51.33 | |
| Qwen2.5-VL-3B + SFT+GRPOBackbone=Qwen2.5-VL-3B2026.03 | 51.07 | |
| Qwen2.5-VL-3B + SFT+DPO+GRPOBackbone=Qwen2.5-VL-3B2026.03 | 51 | |
| Qwen2.5-VL-3B + SFT+DPOBackbone=Qwen2.5-VL-3B2026.03 | 50.87 | |
| GPT-4VSize=Unknown, Feedback=Unknown2024.05 | 50.4 | |
| Qwen2.5-VL-7B + VLGuardBackbone=Qwen2.5-VL-7B2026.03 | 49.87 | |
| Qwen2.5-VL-3BBackbone=Qwen2.5-VL-3B2026.03 | 49.4 | |
| Qwen2.5-VL-3B + SPA-VLBackbone=Qwen2.5-VL-3B2026.03 | 47.2 | |
| MiniGeminiSize=34B, Feedback=X2024.05 | 45.5 | |
| Qwen2.5-VL-3B + SaFeR-VLMBackbone=Qwen2.5-VL-3B2026.03 | 44.13 | |
| Qwen2.5-VL-3B + TISBackbone=Qwen2.5-VL-3B2026.03 | 42.33 | |
| OmniLMM + RLAIF-VSize=12B, Feedback=self2024.05 | 40.9 | |
| OmniLMMSize=12B, Feedback=X2024.05 | 39.7 | |
| LLaVA 1.5 + RLAIF-VSize=7B, Feedback=LLaVA-NeXT2024.05 | 35.4 | |
| AMP-MEGSize=13B, Feedback=Rule2024.05 | 34.8 | |
| Qwen-VL-ChatSize=10B, Feedback=X2024.05 | 34.5 | |
| POVIDSize=7B, Feedback=Rule2024.05 | 34.3 | |
| LLaVA-RLHFSize=13B, Feedback=Human2024.05 | 34.2 | |
| VCDSize=7B, Feedback=X2024.05 | 33.8 | |
| SilkieSize=10B, Feedback=GPT-4V2024.05 | 33.6 | |
| LLaVA 1.5Size=7B, Feedback=X2024.05 | 33.3 | |
| RLHF-VSize=13B, Feedback=Human2024.05 | 33.2 | |
| Less-is-moreSize=7B, Feedback=X2024.05 | 32.9 | |
| OPERASize=7B, Feedback=X2024.05 | 32.9 | |
| HA-DPOSize=7B, Feedback=Rule2024.05 | 32.9 | |
| CCA-LLaVASize=7B, Feedback=X2024.05 | 32.1 |