Spatial Reasoning on SpatialEval Spatial-Map (20% train)
93.4Accuracy (Spatial-Map)LoRA-all
Evaluation Results
| Method | Links | |
|---|---|---|
| LoRA-allBackbone=Qwen2.5-VL-7B, Trainable Parameters=2.97M2026.06 | 93.4 | |
| LoRA-allBackbone=Qwen2.5-VL-3B, Trainable Parameters=2.32M2026.06 | 91.7 | |
| (IA)3Backbone=Qwen2.5-VL-7B, Trainable Parameters=668.5K2026.06 | 91.6 | |
| (IA)3Backbone=Qwen2.5-VL-3B, Trainable Parameters=524.2K2026.06 | 88.6 | |
| LoRA-allBackbone=LLaVA-13B, Trainable Parameters=4.06M2026.06 | 86.8 | |
| LoRA-allBackbone=LLaVA-7B, Trainable Parameters=2.65M2026.06 | 83.2 | |
| (IA)3Backbone=LLaVA-7B, Trainable Parameters=663.6K2026.06 | 80.7 | |
| (IA)3Backbone=LLaVA-13B, Trainable Parameters=1.01M2026.06 | 80.7 | |
| ScAle (attn)Backbone=Qwen2.5-VL-7B, Trainable Parameters=7842026.06 | 76.8 | |
| LoRA-lastBackbone=Qwen2.5-VL-7B, Trainable Parameters=90.1K2026.06 | 74.1 | |
| ScAle (attn)Backbone=Qwen2.5-VL-3B, Trainable Parameters=5762026.06 | 66.8 | |
| FrozenBackbone=Qwen2.5-VL-7B, Trainable Parameters=02026.06 | 66.3 | |
| FrozenBackbone=Qwen2.5-VL-3B, Trainable Parameters=02026.06 | 51.7 | |
| ScAle (attn)Backbone=LLaVA-13B, Trainable Parameters=1.6K2026.06 | 51.5 | |
| LoRA-lastBackbone=Qwen2.5-VL-3B, Trainable Parameters=52.0K2026.06 | 46.2 | |
| ScAle (attn)Backbone=LLaVA-7B, Trainable Parameters=1.0K2026.06 | 45 | |
| LoRA-lastBackbone=LLaVA-13B, Trainable Parameters=97.8K2026.06 | 28.3 | |
| FrozenBackbone=LLaVA-13B, Trainable Parameters=02026.06 | 28 | |
| LoRA-lastBackbone=LLaVA-7B, Trainable Parameters=78.1K2026.06 | 24.3 | |
| FrozenBackbone=LLaVA-7B, Trainable Parameters=02026.06 | 22.7 |