Paired-prompt evaluation on NaturalBench
67.81Simple AccuracyLLaVA-NeXT-Vicuna-7B
Evaluation Results
| Method | Links | |||
|---|---|---|---|---|
| LLaVA-NeXT-Vicuna-7BIntervention=Q4 system redistribution (prop)2026.01 | 67.81 | 37.86 | 65.74 | |
| LLaVA-NeXT-Vicuna-7BIntervention=No-intervention baseline2026.01 | 65.17 | 31.76 | 77.17 |