Multi-image Dialogue Understanding on MMDU
59.8AccuracyStochasT
Evaluation Results
| Method | Links | |
|---|---|---|
| StochasTModel=Qwen-2.5-VL-3B, Evaluation setting=MultiT2026.07 | 59.8 | |
| MultiTModel=Qwen-2.5-VL-3B, Evaluation setting=MultiT2026.07 | 57.9 | |
| OriginalModel=Qwen-2.5-VL-3B, Evaluation setting=MultiT2026.07 | 47 | |
| LLaVA-v1.5Backbone Parameters=7B2025.10 | 26.37 | |
| KORErank=2562025.10 | 23.18 | |
| Replay2025.10 | 19.31 | |
| MoELoRA2025.10 | 17.85 | |
| O-LoRA2025.10 | 17.28 | |
| KORErank=2352025.10 | 16.58 | |
| LoRA2025.10 | 13.7 | |
| LwF2025.10 | 13.68 | |
| EWC2025.10 | 13.36 | |
| StochasTModel=LLaVA-1.5-7B, Evaluation setting=MultiT2026.07 | 13.1 | |
| Full-FTLearning Strategy=Fine-Tuning2025.10 | 13.03 | |
| MultiTModel=LLaVA-1.5-7B, Evaluation setting=MultiT2026.07 | 12.68 | |
| OriginalModel=LLaVA-1.5-7B, Evaluation setting=MultiT2026.07 | 10.81 | |
| SEFE2025.10 | 10.55 | |
| CIA2025.10 | 10.4 |