Cross-view Temporal Reasoning on EgoExo-Con G-Ego
21.6AccuracyQwen2.5-VL-7B + View-GRPO
Evaluation Results
| Method | Links | |
|---|---|---|
| Qwen2.5-VL-7B + View-GRPOBackbone=Qwen2.5-VL-7B, Training Protocol=View-GRPO2025.10 | 21.6 | |
| Qwen2.5-VL-3B + View-GRPOBackbone=Qwen2.5-VL-3B, Training Protocol=View-GRPO2025.10 | 17.9 | |
| Qwen2.5-VL-7B + SFTBackbone=Qwen2.5-VL-7B, Training Protocol=SFT2025.10 | 17.8 | |
| InternVL3.5-8B + View-GRPOBackbone=InternVL3.5-8B, Training Protocol=View-GRPO2025.10 | 16.8 | |
| Qwen2.5-VL-3B + SFTBackbone=Qwen2.5-VL-3B, Training Protocol=SFT2025.10 | 16.6 | |
| Qwen2.5-VL-3B + GRPOBackbone=Qwen2.5-VL-3B, Training Protocol=GRPO2025.10 | 16.3 | |
| Qwen2.5-VL-7B + GRPOBackbone=Qwen2.5-VL-7B, Training Protocol=GRPO2025.10 | 16.1 | |
| Qwen2.5-VL-7BBackbone=Qwen2.5-VL-7B, Training Protocol=Base2025.10 | 11.4 | |
| Qwen2.5-VL-3BBackbone=Qwen2.5-VL-3B, Training Protocol=Base2025.10 | 9.9 | |
| InternVL3.5-8BBackbone=InternVL3.5-8B, Training Protocol=Base2025.10 | 6.7 |