Question Answering on ScienceQA
98.8AccuracyOneVision-8B
Evaluation Results
| Method | Links | |
|---|---|---|
| OneVision-8BModel=OneVision-8B2026.06 | 98.8 | |
| OneVision-4BModel=OneVision-4B2026.06 | 98.5 | |
| InternVL2-8BModel=InternVL2-8B2026.06 | 97.2 | |
| InternVL2-4BModel=InternVL2, Parameter Count=4B, Result Source=OpenVLM Leaderboard (OpenCompass, 2025)2026.04 | 96.3 | |
| LLaVA-OneVision-7BModel Scale=7B2024.08 | 96 | |
| UDSModel=Qwen-2.5-7B2025.10 | 95.19 | |
| LLaVA-OneVision-7BModel=LLaVA-OneVision, Parameter Count=7B2026.04 | 94.71 | |
| PESC (block-wise)Backbone=Mistral-7B, Evaluation Protocol=domain-specific fine-tuning2026.03 | 94.33 | |
| LoRABackbone=Mistral-7B, Evaluation Protocol=domain-specific fine-tuning2026.03 | 94.15 | |
| FisherSFTModel=Qwen-2.5-7B2025.10 | 94.02 | |
| AdaFuseBackbone=Mistral-7B, Evaluation Protocol=domain-specific fine-tuning2026.03 | 93.82 | |
| MoRAL (layer-wise)Backbone=Mistral-7B, Evaluation Protocol=domain-specific fine-tuning2026.03 | 93.79 | |
| Qwen3-VL-4BModel=Qwen3-VL, Parameter Count=4B2026.04 | 93.42 | |
| InfiniteVL-4BModel=InfiniteVL, Parameter Count=4B, Result Source=InfiniteVL (Tao et al., 2025) paper2026.04 | 93.4 | |
| Llama-90BModel=Llama-90B2026.06 | 91.4 | |
| Single Task SoTA2023.12 | 90.9 | |
| LLaVA-OneVision-72BModel Scale=72B2024.08 | 90.3 | |
| Pragma-VLBackbone=Qwen2.5-VL-7B2026.02 | 89.06 | |
| SFTBackbone=Qwen2.5-VL-7B2026.02 | 89.01 | |
| DPOBackbone=Qwen2.5-VL-7B2026.02 | 88.86 | |
| UIO-2XLModel Size=3.2B2023.12 | 88.8 | |
| UIO-2XXLModel Size=6.8B2023.12 | 88.7 | |
| Qwen2.5-VL-7BBackbone=Qwen2.5-VL-7B2026.02 | 88.48 | |
| MM-RLHFBackbone=Qwen2.5-VL-7B2026.02 | 87.45 | |
| SmolVLM2-2.2BModel=SmolVLM2, Parameter Count=2.2B2026.04 | 86.6 | |
| SPA-VLBackbone=Qwen2.5-VL-7B2026.02 | 86.32 | |
| Beavertails-V_helpBackbone=Qwen2.5-VL-7B2026.02 | 86.06 | |
| Beavertails-V_harmBackbone=Qwen2.5-VL-7B2026.02 | 85.93 | |
| SliMELLM=Llama3-8B2024.11 | 84.2 | |
| HalluVL-DPOBackbone=Qwen2-VL-7B2026.04 | 82.2 | |
| UIO-2LModel Size=1.1B2023.12 | 81.6 | |
| SpB2.0-VL-5BModel=SpB2.0-VL, Parameter Count=5B2026.04 | 81.55 | |
| OneVision-4B-LNModel=OneVision-4B-LN2026.06 | 81.5 | |
| HalluVL-DPOwBackbone=Qwen2-VL-7B2026.04 | 81.36 | |
| VCDBackbone=Qwen2-VL-7B2026.04 | 81.21 | |
| Qwen2-VL-7BBackbone=Qwen2-VL-7B2026.04 | 81.06 | |
| Cambrian-8BModel=Cambrian-8B2026.06 | 80.3 | |
| Qwen2.5-VL-3BModel=Qwen2.5-VL, Parameter Count=3B2026.04 | 79.54 | |
| InstructBLIPModel Size=8.2B2023.12 | 79.5 | |
| FocusLLaVALLM=Llama3-8B2024.11 | 79 | |
| LLaVA-NeXTLLM=Llama3-8B, implementation=ours2024.11 | 77.3 | |
| GPT-4VVersion=V-Preview2024.08 | 75.7 | |
| HiREDLLM=Vicuna-13B2024.11 | 73.2 | |
| SeqRound Learned=R4, Task Type=New Task2026.01 | 73 | |
| OSWRound Learned=R4, Task Type=New Task2026.01 | 73 | |
| Naive SelectionParam. Scale=Extra Large2026.03 | 72.9 | |
| AblationRound Learned=R4, Task Type=New Task2026.01 | 72 | |
| SCoOPParam. Scale=Extra Large2026.03 | 71.85 | |
| LLaVa-1.5Model Size=13B, Zero-shot=true2023.12 | 71.6 | |
| Majority VotingParam. Scale=Medium2026.03 | 71.53 | |
| SCoOPParam. Scale=Medium2026.03 | 71.32 | |
| LLaVA-13BModel=LLaVA-13B2026.06 | 71.2 | |
| Majority VotingParam. Scale=Extra Large2026.03 | 71.11 | |
| Majority VotingParam. Scale=Large2026.03 | 70.69 | |
| LLaVA-NeXTLLM=Vicuna-7B2024.11 | 70.1 | |
| SCoOPParam. Scale=Large2026.03 | 70.06 | |
| Avg. of Single ModelsParam. Scale=Extra Large2026.03 | 69.75 | |
| Naive SelectionParam. Scale=Medium2026.03 | 69.43 | |
| MonkeyParameters=9.8B, Resolution=896x8962023.11 | 69.4 | |
| Cobra-3BModel=Cobra, Parameter Count=3B, Result Source=InfiniteVL (Tao et al., 2025) paper2026.04 | 69.3 | |
| Avg. of Single ModelsParam. Scale=Large2026.03 | 69.16 | |
| TrimLLM=Vicuna-7B2024.11 | 69.1 | |
| Naive SelectionParam. Scale=Large2026.03 | 68.91 | |
| Pragma-VLBackbone=Llava-1.5-7B2026.02 | 68.75 | |
| mPLUG-Owl2Model Size=8.2B, Zero-shot=true2023.12 | 68.7 | |
| mPLUG-Owl22023.11 | 68.7 | |
| LLaVA-Prumerge+LLM=Vicuna-7B2024.11 | 68.3 | |
| Qwen-VL-Chat2023.11 | 68.2 | |
| LLaVA-7BModel=LLaVA-7B2026.06 | 67.7 | |
| Majority VotingParam. Scale=Small2026.03 | 67.44 | |
| SCoOPParam. Scale=Small2026.03 | 67.33 | |
| LLaVA-OneVision-0.5BModel Scale=0.5B2024.08 | 67.2 | |
| Qwen-VLModel Size=9.6B, Zero-shot=true2023.12 | 67.1 | |
| Qwen-VLBackbone=Qwen-7B2023.11 | 67.1 | |
| ReplayRound Learned=R4, Task Type=New Task2026.01 | 67 | |
| LLaVa-1.5Model Size=7.2B, Zero-shot=true2023.12 | 66.8 | |
| LLaVA-1.5LLM Type=Vicuna-7B2024.03 | 66.8 | |
| LLaVA1.5Backbone=Vicuna-7B2023.11 | 66.8 | |
| SFTBackbone=Llava-1.5-7B2026.02 | 66.79 | |
| Naive SelectionParam. Scale=Small2026.03 | 66.49 | |
| DPOBackbone=Llava-1.5-7B2026.02 | 66.25 | |
| Avg. of Single ModelsParam. Scale=Medium2026.03 | 66.05 | |
| MM-RLHFBackbone=Llava-1.5-7B2026.02 | 66.01 | |
| Llava-1.5-7BBackbone=Llava-1.5-7B2026.02 | 65.96 | |
| MaTVLM-3BModel=MaTVLM, Parameter Count=3B, Result Source=InfiniteVL (Tao et al., 2025) paper2026.04 | 65.9 | |
| LLaVA-1.5-7BBackbone=LLaVA-1.5-7B2026.04 | 65.54 | |
| SPA-VLBackbone=Llava-1.5-7B2026.02 | 65.52 | |
| Beavertails-V_helpBackbone=Llava-1.5-7B2026.02 | 65.23 | |
| Beavertails-V_harmBackbone=Llava-1.5-7B2026.02 | 64.94 | |
| PSALMLLM Type=Phi-1.5 (1.3B)2024.03 | 64.9 | |
| AntidoteBackbone=LLaVA-1.5-7B, Hyperparameter Configuration=HP-orig2026.04 | 64.55 | |
| AntidoteBackbone=LLaVA-1.5-7B, Hyperparameter Configuration=HP-search2026.04 | 63.36 | |
| InstructBLIPBackbone=Vicuna-13B2023.11 | 63.1 | |
| HalluVL-DPOwBackbone=LLaVA-1.5-7B2026.04 | 63.01 | |
| Avg. of Single ModelsParam. Scale=Small2026.03 | 62.95 | |
| HalluVL-DPOBackbone=LLaVA-1.5-7B2026.04 | 62.71 | |
| Mini-Gemini (MGM-2B)#Tokens=18432, Compression Ratio (CR)=100%, Training Time=18.1h2024.06 | 62.7 | |
| VCDBackbone=LLaVA-1.5-7B2026.04 | 62.67 | |
| Mistral-7B (base)Backbone=Mistral-7B, Evaluation Protocol=Base2026.03 | 62.24 | |
| LLaVolta (MGM-2B backbone)#Tokens=10863, Compression Ratio (CR)=170%, Training Time=14.8h2024.06 | 62.2 |