High-Resolution Visual Reasoning on HRBench
0.7512AccuracyVision-R1
Evaluation Results
| Method | Links | |
|---|---|---|
| Vision-R1Reasoning Paradigm=Tool-use & RL Enhanced Reasoning2026.01 | 0.7512 | |
| LaserReasoning Paradigm=Latent Reasoning2026.01 | 0.725 | |
| REWARDMAPModel=Qwen2.5-VL-7B-Instruct, Training Strategy=REWARDMAP2025.10 | 0.7125 | |
| Qwen2.5-VL-7B-Instruct + SFT -> RLModel=Qwen2.5-VL-7B-Instruct, Training Strategy=SFT -> RL Baseline2025.10 | 0.71 | |
| DeepEyesReasoning Paradigm=Tool-use & RL Enhanced Reasoning2026.01 | 0.6912 | |
| Qwen2.5-VL-7B-InstructModel=Qwen2.5-VL-7B-Instruct, Training Strategy=Base Model2025.10 | 0.6875 | |
| Qwen2.5-VL-7BReasoning Paradigm=Zero-Shot VLMs2026.01 | 0.6825 | |
| PAPOReasoning Paradigm=Tool-use & RL Enhanced Reasoning2026.01 | 0.6812 | |
| MonetReasoning Paradigm=Latent Reasoning2026.01 | 0.68 | |
| Qwen2.5-VL-3B-InstructModel=Qwen2.5-VL-3B-Instruct, Training Strategy=Reference2025.10 | 0.6625 | |
| VL-RethinkerReasoning Paradigm=Tool-use & RL Enhanced Reasoning2026.01 | 0.635 | |
| Qwen2.5-VL-32B-InstructModel=Qwen2.5-VL-32B-Instruct, Training Strategy=Reference2025.10 | 0.635 | |
| LLaVA-OneVisionReasoning Paradigm=Zero-Shot VLMs2026.01 | 0.63 | |
| InternVL3.5-8BReasoning Paradigm=Zero-Shot VLMs2026.01 | 0.5938 | |
| Kimi-VL-A3B-InstructModel=Kimi-VL-A3B-Instruct, Training Strategy=Reference2025.10 | 0.5538 | |
| LVRReasoning Paradigm=Latent Reasoning2026.01 | 0.5362 |