Spatial Reasoning on SpatialEval Maze-Nav 20% (train)
86.2AccuracyLoRA-all
Evaluation Results
| Method | Links | |
|---|---|---|
| LoRA-allBackbone=Qwen2.5-VL-7B, Trainable Parameters=2.97M2026.06 | 86.2 | |
| (IA)3Backbone=Qwen2.5-VL-3B, Trainable Parameters=524.2K2026.06 | 82.2 | |
| (IA)3Backbone=Qwen2.5-VL-7B, Trainable Parameters=668.5K2026.06 | 80.9 | |
| LoRA-allBackbone=Qwen2.5-VL-3B, Trainable Parameters=2.32M2026.06 | 79.9 | |
| LoRA-allBackbone=LLaVA-13B, Trainable Parameters=4.06M2026.06 | 75.2 | |
| LoRA-allBackbone=LLaVA-7B, Trainable Parameters=2.65M2026.06 | 71.6 | |
| (IA)3Backbone=LLaVA-7B, Trainable Parameters=663.6K2026.06 | 70.8 | |
| (IA)3Backbone=LLaVA-13B, Trainable Parameters=1.01M2026.06 | 70.5 | |
| ScAle (attn)Backbone=Qwen2.5-VL-3B, Trainable Parameters=5762026.06 | 70.3 | |
| ScAle (attn)Backbone=LLaVA-13B, Trainable Parameters=1.6K2026.06 | 69.8 | |
| ScAle (attn)Backbone=LLaVA-7B, Trainable Parameters=1.0K2026.06 | 68.9 | |
| LoRA-lastBackbone=Qwen2.5-VL-7B, Trainable Parameters=90.1K2026.06 | 66.5 | |
| ScAle (attn)Backbone=Qwen2.5-VL-7B, Trainable Parameters=7842026.06 | 66.2 | |
| LoRA-lastBackbone=LLaVA-7B, Trainable Parameters=78.1K2026.06 | 53.6 | |
| LoRA-lastBackbone=LLaVA-13B, Trainable Parameters=97.8K2026.06 | 46.2 | |
| LoRA-lastBackbone=Qwen2.5-VL-3B, Trainable Parameters=52.0K2026.06 | 41.8 | |
| FrozenBackbone=Qwen2.5-VL-7B, Trainable Parameters=02026.06 | 38.3 | |
| FrozenBackbone=LLaVA-7B, Trainable Parameters=02026.06 | 31.7 | |
| FrozenBackbone=LLaVA-13B, Trainable Parameters=02026.06 | 26.7 | |
| FrozenBackbone=Qwen2.5-VL-3B, Trainable Parameters=02026.06 | 26 |