Hallucination Detection on POPE
91.22AccuracyDCLA
Evaluation Results
| Method | Links | ||
|---|---|---|---|
| DCLAModel=InternVL3-8B, Decoding=DCLA2025.05 | 91.22 | 91.04 | |
| VCDModel=InternVL3-8B, Decoding=VCD2025.05 | 91.06 | 90.94 | |
| GreedyModel=InternVL3-8B, Decoding=Greedy2025.05 | 90.89 | 90.68 | |
| DAMOModel=InternVL3-8B, Decoding=DAMO2025.05 | 90.6 | 90.15 | |
| DAMOModel=Qwen3-VL-8B, Decoding=DAMO2025.05 | 90.06 | 89.65 | |
| GreedyModel=Qwen3-VL-8B, Decoding=Greedy2025.05 | 89.88 | 89.52 | |
| DCLAModel=Qwen3-VL-8B, Decoding=DCLA2025.05 | 89.74 | 89.67 | |
| VCDModel=Qwen3-VL-8B, Decoding=VCD2025.05 | 89.72 | 89.55 | |
| VCDModel=Qwen2.5-VL-7B, Decoding=VCD2025.05 | 88.62 | 87.58 | |
| DCLAModel=Qwen2.5-VL-7B, Decoding=DCLA2025.05 | 88.24 | 87.46 | |
| GreedyModel=Qwen2.5-VL-7B, Decoding=Greedy2025.05 | 87.7 | 86.38 | |
| DAMOModel=Qwen2.5-VL-7B, Decoding=DAMO2025.05 | 87.43 | 86.02 | |
| VisPrunerToken Budget (K)=192, Token Reduction (%)=↓ 66.7%, Model Backbone=LLaVA-1.5-7B2026.06 | 86.2 | — | |
| VanillaToken Budget (K)=576, Token Reduction (%)=100%, Model Backbone=LLaVA-1.5-7B2026.06 | 85.9 | — | |
| SINKTRACKBase LLM=Qwen2.5-VL-7B-Instruct2026.04 | 85.47 | 91.67 | |
| SINKTRACKBase LLM=Gemma3-12B-Instruct2026.04 | 85.4 | 92.13 | |
| DirectBase LLM=Gemma3-12B-Instruct2026.04 | 84.59 | 91.65 | |
| CoTBase LLM=Gemma3-12B-Instruct2026.04 | 84.53 | 91.61 | |
| SINKTRACKBase LLM=Gemma3-4B-Instruct2026.04 | 84.33 | 91.5 | |
| VisPrunerToken Budget (K)=128, Token Reduction (%)=↓ 77.8%, Model Backbone=LLaVA-1.5-7B2026.06 | 84.3 | — | |
| DirectBase LLM=Gemma3-4B-Instruct2026.04 | 83.98 | 91.3 | |
| PriorTRToken Budget (K)=192, Token Reduction (%)=↓ 66.7%, Model Backbone=LLaVA-1.5-7B2026.06 | 83.8 | — | |
| CoTBase LLM=Qwen2.5-VL-7B-Instruct2026.04 | 83.65 | 90.63 | |
| SparseVLMToken Budget (K)=192, Token Reduction (%)=↓ 66.7%, Model Backbone=LLaVA-1.5-7B2026.06 | 83.6 | — | |
| PDropToken Budget (K)=192, Token Reduction (%)=↓ 66.7%, Model Backbone=LLaVA-1.5-7B2026.06 | 82.3 | — | |
| PDropToken Budget (K)=128, Token Reduction (%)=↓ 77.8%, Model Backbone=LLaVA-1.5-7B2026.06 | 82.3 | — | |
| CoTBase LLM=Gemma3-4B-Instruct2026.04 | 82.01 | 90.04 | |
| PriorTRToken Budget (K)=128, Token Reduction (%)=↓ 77.8%, Model Backbone=LLaVA-1.5-7B2026.06 | 81.7 | — | |
| SparseVLMToken Budget (K)=128, Token Reduction (%)=↓ 77.8%, Model Backbone=LLaVA-1.5-7B2026.06 | 80.5 | — | |
| VisPrunerToken Budget (K)=64, Token Reduction (%)=↓ 88.9%, Model Backbone=LLaVA-1.5-7B2026.06 | 80.4 | — | |
| DirectBase LLM=Qwen2.5-VL-7B-Instruct2026.04 | 78.21 | 87.15 | |
| SINKTRACKBase LLM=Qwen2.5-VL-3B-Instruct2026.04 | 77.69 | 87.44 | |
| PriorTRToken Budget (K)=64, Token Reduction (%)=↓ 88.9%, Model Backbone=LLaVA-1.5-7B2026.06 | 76.3 | — | |
| SparseVLMToken Budget (K)=64, Token Reduction (%)=↓ 88.9%, Model Backbone=LLaVA-1.5-7B2026.06 | 75.1 | — | |
| PruMergeToken Budget (K)=192, Token Reduction (%)=↓ 66.7%, Model Backbone=LLaVA-1.5-7B2026.06 | 71.3 | — | |
| PruMergeToken Budget (K)=128, Token Reduction (%)=↓ 77.8%, Model Backbone=LLaVA-1.5-7B2026.06 | 67.1 | — | |
| PruMergeToken Budget (K)=64, Token Reduction (%)=↓ 88.9%, Model Backbone=LLaVA-1.5-7B2026.06 | 65.3 | — | |
| CoTBase LLM=Qwen2.5-VL-3B-Instruct2026.04 | 64.58 | 78.1 | |
| FastVToken Budget (K)=192, Token Reduction (%)=↓ 66.7%, Model Backbone=LLaVA-1.5-7B2026.06 | 61 | — | |
| PDropToken Budget (K)=64, Token Reduction (%)=↓ 88.9%, Model Backbone=LLaVA-1.5-7B2026.06 | 55.9 | — | |
| FastVToken Budget (K)=128, Token Reduction (%)=↓ 77.8%, Model Backbone=LLaVA-1.5-7B2026.06 | 53.4 | — | |
| DirectBase LLM=Qwen2.5-VL-3B-Instruct2026.04 | 53.23 | 69.48 | |
| FastVToken Budget (K)=64, Token Reduction (%)=↓ 88.9%, Model Backbone=LLaVA-1.5-7B2026.06 | 38.2 | — |