General Visual Question Answering on RealWorldQA
73.1ScoreBee-8B
Evaluation Results
| Method | Links | |
|---|---|---|
| Bee-8BOpenness=fully open, Model Size=8B, Training Strategy=RL2025.10 | 73.1 | |
| MolmoOpenness=fully open, Model Size=7B, Training Strategy=Distilled (-D)2025.10 | 70.7 | |
| Bee-8BOpenness=fully open, Model Size=8B, Training Strategy=SFT2025.10 | 70.1 | |
| SpatialSSRLBackbone=Qwen2.5-VL-7B2026.04 | 69.9 | |
| BaselineBackbone=Qwen2.5-VL-7B2026.04 | 69.5 | |
| Qwen2.5-VLOpenness=semi-open, Model Size=7B2025.10 | 68.5 | |
| BaseModel=Qwen3-VL-4B2026.07 | 68.24 | |
| Keye-VLOpenness=semi-open, Model Size=8B2025.10 | 67.7 | |
| InternVL3.5Openness=semi-open, Model Size=8B2025.10 | 67.5 | |
| SpatialEvoBackbone=Qwen2.5-VL-7B2026.04 | 66.7 | |
| SpatialEvoBackbone=Qwen2.5-VL-3B2026.04 | 66.5 | |
| LLaVA OneVisionOpenness=fully open, Model Size=7B2025.10 | 66.3 | |
| SpatialSSRLBackbone=Qwen2.5-VL-3B2026.04 | 65.4 | |
| SpaceRBackbone=Qwen2.5-VL-7B2026.04 | 64.7 | |
| CPOModel=Qwen3-VL-4B2026.07 | 64.58 | |
| BaselineBackbone=Qwen2.5-VL-3B2026.04 | 63.4 | |
| LoRAModel=Qwen3-VL-4B2026.07 | 61.7 | |
| SpaceRBackbone=Qwen2.5-VL-3B2026.04 | 61.4 | |
| GSPOModel=Qwen3-VL-4B2026.07 | 58.17 | |
| HIVEBackbone=Huginn, Param.=4B, Train Data=6.5M, Recurrence Level (r)=322026.02 | 57.9 | |
| ViLaSRBackbone=Qwen2.5-VL-7B2026.04 | 57.9 | |
| BaseFine-tuning setting=Base, Backbone=Qwen3-VL-2B2026.07 | 57.78 | |
| Emu3Param.=8B2026.02 | 57.4 | |
| SpatialLadderBackbone=Qwen2.5-VL-3B2026.04 | 57.1 | |
| CPOFine-tuning setting=CPO, Backbone=Qwen3-VL-2B2026.07 | 54.77 | |
| GRPOFine-tuning setting=GRPO, Backbone=Qwen3-VL-2B2026.07 | 54.51 | |
| LoRAFine-tuning setting=LoRA, Backbone=Qwen3-VL-2B2026.07 | 54.25 | |
| FFTModel=Qwen3-VL-4B2026.07 | 51.63 | |
| FFTFine-tuning setting=FFT, Backbone=Qwen3-VL-2B2026.07 | 51.11 | |
| GSPOFine-tuning setting=GSPO, Backbone=Qwen3-VL-2B2026.07 | 46.01 | |
| Gemma3-4B-PTBackbone=Gemma3, Param.=4B, Train Data=4T*2026.02 | 45.5 | |
| GRPOModel=Qwen3-VL-4B2026.07 | 43.4 |