Object Hallucination Detection on Object Hall-Bench
63Res ScoreLLaVA
Evaluation Results
| Method | Links | ||
|---|---|---|---|
| LLaVAModel Size=13B, Baseline Category=LVLMs2024.11 | 63 | 29.5 | |
| MuffinModel Size=13B, Baseline Category=LVLMs2024.11 | 50.5 | 24.5 | |
| POVIDModel Size=7B, Baseline Category=reinforcement learning-based2024.11 | 48.1 | 24.4 | |
| VCDModel Size=7B, Baseline Category=training-free2024.11 | 47.4 | 25.24 | |
| ICDModel Size=7B, Baseline Category=training-free2024.11 | 47.4 | 25 | |
| LLaVA-1.5Model Size=13B, Baseline Category=LVLMs2024.11 | 47.06 | 23.33 | |
| LLaVA-1.5Model Size=7B, Baseline Category=LVLMs2024.11 | 46.71 | 25.08 | |
| VDD-NoneModel Size=7B, Baseline Category=training-free2024.11 | 46.71 | 25.19 | |
| VCDModel Size=13B, Baseline Category=training-free2024.11 | 46.37 | 23.1 | |
| ICDModel Size=13B, Baseline Category=training-free2024.11 | 45.52 | 21.93 | |
| OPERAModel Size=7B, Baseline Category=training-free2024.11 | 45.1 | 22.3 | |
| VDD-NoneModel Size=13B, Baseline Category=training-free2024.11 | 44.64 | 22.23 | |
| QWEN-VLModel Size=10B, Baseline Category=LVLMs2024.11 | 40.4 | 20.7 | |
| Less-is-moreModel Size=7B, Baseline Category=training-free2024.11 | 40.3 | 17.8 | |
| HA-DPOModel Size=7B, Baseline Category=reinforcement learning-based2024.11 | 39.9 | 19.9 | |
| LLaVA-RLHFModel Size=13B, Baseline Category=reinforcement learning-based2024.11 | 38.1 | 18.9 | |
| LRVModel Size=7B, Baseline Category=training-free2024.11 | 32.3 | 22.3 | |
| LLaVA1.5-7B-BPOModel Size=7B, Baseline Category=reinforcement learning-based2024.11 | 31.9 | 15.1 | |
| LACINGModel Size=7B2024.11 | 27.86 | 14.22 | |
| LLaVA1.5-13B-BPOModel Size=13B, Baseline Category=reinforcement learning-based2024.11 | 27.3 | 12.9 | |
| LACINGModel Size=13B2024.11 | 27.21 | 14.1 | |
| RLHF-VModel Size=13B, Baseline Category=reinforcement learning-based2024.11 | 12.2 | 7.5 |