Vision-Centric / 3D on CV-Bench 2D
82.5AccuracyINTERNVL3-8B + PGT
Evaluation Results
| Method | Links | |
|---|---|---|
| INTERNVL3-8B + PGTBackbone=INTERNVL3-8B, Data=PGT-augmented2026.05 | 82.5 | |
| INTERNVL3-8BBackbone=INTERNVL3-8B2026.05 | 81.4 | |
| QWEN2.5-VL-7B + SPECIALIZED MIXBackbone=QWEN2.5-VL-7B, Data=Specialized Mix2026.05 | 78.7 | |
| QWEN2.5-VL-7B + PGTBackbone=QWEN2.5-VL-7B, Data=PGT-augmented2026.05 | 78.2 | |
| VIGORL-3BMethod=VIGORL-3B2026.05 | 78 | |
| IMAGE JIGSAWMethod=IMAGE JIGSAW2026.05 | 77.8 | |
| QWEN2.5-VL-7BBackbone=QWEN2.5-VL-7B2026.05 | 77.7 | |
| THINKLITE-VLMethod=THINKLITE-VL2026.05 | 76.6 | |
| QWEN2.5-VL-3B + PGTBackbone=QWEN2.5-VL-3B, Data=PGT-augmented2026.05 | 74.4 | |
| SPATIAL-LADDER-3BMethod=SPATIAL-LADDER-3B2026.05 | 72.4 | |
| QWEN2.5-VL-3BBackbone=QWEN2.5-VL-3B2026.05 | 70.9 | |
| QWEN2.5-VL-3B + SPECIALIZED MIXBackbone=QWEN2.5-VL-3B, Data=Specialized Mix2026.05 | 70.8 | |
| LLAVA-NEXT-7B + PGTBackbone=LLAVA-NEXT-7B, Data=PGT-augmented2026.05 | 67.8 | |
| LLAVA-NEXT-LLAMA3-8B + PGTBackbone=LLAVA-NEXT-LLAMA3-8B, Data=PGT-augmented2026.05 | 65.7 | |
| LLAVA-NEXT-LLAMA3-8BBackbone=LLAVA-NEXT-LLAMA3-8B2026.05 | 62.9 | |
| LLAVA-NEXT-7BBackbone=LLAVA-NEXT-7B2026.05 | 59.5 |