Paired-prompt evaluation on HallusionBench
52.89Simple AccuracyLLaVA-NeXT-Vicuna-7B
Evaluation Results
| Method | Links | |||
|---|---|---|---|---|
| LLaVA-NeXT-Vicuna-7BIntervention=Q4 system redistribution (prop)2026.01 | 52.89 | 16.74 | 61.51 | |
| LLaVA-NeXT-Vicuna-7BIntervention=No-intervention baseline2026.01 | 47.63 | 12.33 | 87.17 |