Medical Visual Question Answering on SLAKE closed-end
92.39AccuracyMEDALIGN
Evaluation Results
| Method | Links | |
|---|---|---|
| MEDALIGNMed-LVLM=HuatuoGPT-Vision + LoRA2025.12 | 92.39 | |
| AVISCMed-LVLM=HuatuoGPT-Vision + LoRA2025.12 | 91.27 | |
| NucleusMed-LVLM=HuatuoGPT-Vision + LoRA2025.12 | 90.42 | |
| GreedyMed-LVLM=HuatuoGPT-Vision + LoRA2025.12 | 90.14 | |
| BeamMed-LVLM=HuatuoGPT-Vision + LoRA2025.12 | 90.14 | |
| OPERAMed-LVLM=HuatuoGPT-Vision + LoRA2025.12 | 90.14 | |
| PAIMed-LVLM=HuatuoGPT-Vision + LoRA2025.12 | 90.14 | |
| DoLaMed-LVLM=HuatuoGPT-Vision + LoRA2025.12 | 89.86 | |
| M3IDMed-LVLM=HuatuoGPT-Vision + LoRA2025.12 | 89.86 | |
| VCDMed-LVLM=HuatuoGPT-Vision + LoRA2025.12 | 89.58 | |
| DAMROMed-LVLM=HuatuoGPT-Vision + LoRA2025.12 | 89.58 | |
| PAIMed-LVLM=LLaVA-Med-1.5 + LoRA2025.12 | 89.01 | |
| MEDALIGNMed-LVLM=LLaVA-Med-1.5 + LoRA2025.12 | 89.01 | |
| GreedyMed-LVLM=LLaVA-Med-1.5 + LoRA2025.12 | 88.45 | |
| BeamMed-LVLM=LLaVA-Med-1.5 + LoRA2025.12 | 88.45 | |
| DoLaMed-LVLM=LLaVA-Med-1.5 + LoRA2025.12 | 88.45 | |
| OPERAMed-LVLM=LLaVA-Med-1.5 + LoRA2025.12 | 88.45 | |
| Phi3.5V-MedEvaluation Protocol=Fine-Tuning, Decoding Strategy=Greedy2025.12 | 88.19 | |
| Phi3.5V-MedEvaluation Protocol=Fine-Tuning, Decoding Strategy=VCD2025.12 | 88.19 | |
| Phi3.5V-MedEvaluation Protocol=Fine-Tuning, Decoding Strategy=ARCD2025.12 | 88.19 | |
| V2T-COT(Phi2)w/ MLLM=true, Act.=2.7B2025.06 | 87.61 | |
| Phi3.5V-MedEvaluation Protocol=Fine-Tuning, Decoding Strategy=OPERA2025.12 | 87.4 | |
| AVISCMed-LVLM=LLaVA-Med-1.5 + LoRA2025.12 | 87.32 | |
| M3IDMed-LVLM=LLaVA-Med-1.5 + LoRA2025.12 | 87.04 | |
| BiomedGPT-Mw/ MLLM=false2025.06 | 86.8 | |
| NucleusMed-LVLM=LLaVA-Med-1.5 + LoRA2025.12 | 86.76 | |
| VCDMed-LVLM=LLaVA-Med-1.5 + LoRA2025.12 | 86.76 | |
| DAMROMed-LVLM=LLaVA-Med-1.5 + LoRA2025.12 | 86.76 | |
| Phi3.5V-MedEvaluation Protocol=Fine-Tuning, Decoding Strategy=DoLA2025.12 | 86.61 | |
| V2T-COT (Stablelm)w/ MLLM=true, Act.=1.6B2025.06 | 86.48 | |
| MedThinkw/ MLLM=false, Act.=223M2025.06 | 86.3 | |
| LLaVA-Med(LLama)w/ MLLM=true, Act.=7B2025.06 | 85.34 | |
| LLaVA-Medtraining_setting=fully finetuned2024.04 | 85.3 | |
| Med-MoEw/ MLLM=true, Act.=2.0B2025.06 | 83.41 | |
| LLaVA-Med(Phi2)w/ MLLM=true, Act.=2.7B2025.06 | 83.29 | |
| LLaVA-Med(Vicuna)w/ MLLM=true, Act.=7B2025.06 | 83.17 | |
| PubMedCLIPw/ MLLM=false2025.06 | 82.5 | |
| Prefix T. Medical LMw/ MLLM=true, Act.=1.5B2025.06 | 82.01 | |
| GPT-4oEvaluation Protocol=General Domain, Decoding Strategy=Greedy2025.12 | 74.8 | |
| HuatuoV-34BEvaluation Protocol=Zero-Shot, Decoding Strategy=Greedy2025.12 | 74.02 | |
| Gemini Prow/ MLLM=false2025.06 | 72.6 | |
| MOVAbackbone_parameters=7B2024.04 | 68.8 | |
| Phi3.5V-MedEvaluation Protocol=Zero-Shot, Decoding Strategy=OPERA2025.12 | 65.35 | |
| LLaVA-1.52024.04 | 63.7 | |
| LLAVAw/ MLLM=true, Act.=7B2025.06 | 63.22 | |
| Qwen-VL-7BEvaluation Protocol=General Domain, Decoding Strategy=Greedy2025.12 | 61.42 | |
| Phi3.5V-MedEvaluation Protocol=Zero-Shot, Decoding Strategy=Greedy2025.12 | 61.42 | |
| Phi3.5V-MedEvaluation Protocol=Zero-Shot, Decoding Strategy=VCD2025.12 | 61.42 | |
| Phi3.5V-MedEvaluation Protocol=Zero-Shot, Decoding Strategy=ARCD2025.12 | 61.42 | |
| Phi3.5V-MedEvaluation Protocol=Zero-Shot, Decoding Strategy=DoLA2025.12 | 59.84 | |
| LLaVA-Med-7BEvaluation Protocol=Zero-Shot, Decoding Strategy=Greedy2025.12 | 55.12 | |
| LLaVA-Medtraining_setting=1-epoch finetuned2024.04 | 54.6 | |
| LLaVA-1.6-7BEvaluation Protocol=General Domain, Decoding Strategy=Greedy2025.12 | 53.54 | |
| Phi3.5V-4.2BEvaluation Protocol=General Domain, Decoding Strategy=Greedy2025.12 | 53.54 |