Open-ended Generation on LLaVA-Bench
84.3GPT-4 ScoreLACING
Evaluation Results
| Method | Links | |
|---|---|---|
| LACINGModel Size=13B2024.11 | 84.3 | |
| LLaVA1.5-13B-BPOModel Size=13B, Baseline Category=reinforcement learning-based2024.11 | 74.4 | |
| VCDModel Size=13B, Baseline Category=training-free2024.11 | 73.6 | |
| VDD-NoneModel Size=13B, Baseline Category=training-free2024.11 | 73 | |
| LLaVA-1.5Model Size=13B, Baseline Category=LVLMs2024.11 | 72.5 | |
| ICDModel Size=13B, Baseline Category=training-free2024.11 | 72.5 | |
| LACINGModel Size=7B2024.11 | 72.2 | |
| LLaVA1.5-7B-BPOModel Size=7B, Baseline Category=reinforcement learning-based2024.11 | 71.6 | |
| LLaVAModel Size=13B, Baseline Category=LVLMs2024.11 | 70.8 | |
| MuffinModel Size=13B, Baseline Category=LVLMs2024.11 | 68.8 | |
| HA-DPOModel Size=7B, Baseline Category=reinforcement learning-based2024.11 | 67.2 | |
| VDD-NoneModel Size=7B, Baseline Category=training-free2024.11 | 66 | |
| VCDModel Size=7B, Baseline Category=training-free2024.11 | 65.3 | |
| ICDModel Size=7B, Baseline Category=training-free2024.11 | 64.7 | |
| LLaVA-1.5Model Size=7B, Baseline Category=LVLMs2024.11 | 64.4 | |
| POVIDModel Size=7B, Baseline Category=reinforcement learning-based2024.11 | 62.2 | |
| LLaVA-RLHFModel Size=13B, Baseline Category=reinforcement learning-based2024.11 | 61.5 | |
| Less-is-moreModel Size=7B, Baseline Category=training-free2024.11 | 60.9 | |
| OPERAModel Size=7B, Baseline Category=training-free2024.11 | 60.3 | |
| QWEN-VLModel Size=10B, Baseline Category=LVLMs2024.11 | 52.1 | |
| RLHF-VModel Size=13B, Baseline Category=reinforcement learning-based2024.11 | 51.4 |