Multiple Object Grounding on Reasoning Segmentation Overall
48.7gIoU (%)LISA
Evaluation Results
| Method | Links | ||
|---|---|---|---|
| LISATraining paradigm=Train LLaVA 1.5-7B, Query source=Original2025.05 | 48.7 | 48.8 | |
| TextRegionQuery source=Interpreted from LLaVA 1.5-7B2025.05 | 42.7 | 42.4 | |
| OVSegQuery source=Interpreted from LLaVA 1.5-7B2025.05 | 39.7 | 31.8 | |
| TridentQuery source=Interpreted from LLaVA 1.5-7B2025.05 | 38.4 | 39.2 | |
| OVSegTraining paradigm=Training-based, VLM usage=No, Query source=Original2025.05 | 26.1 | 20.8 | |
| TextRegionTraining paradigm=Training-free, VLM usage=No, Query source=Original2025.05 | 25.2 | 21.6 | |
| SEEMTraining paradigm=Training-based, VLM usage=No, Query source=Original2025.05 | 24.3 | 18.7 | |
| TridentTraining paradigm=Training-free, VLM usage=No, Query source=Original2025.05 | 23.3 | 20 | |
| X-DecoderTraining paradigm=Training-based, VLM usage=No, Query source=Original2025.05 | 21.7 | 16.3 | |
| Grounded-SAMTraining paradigm=Training-based, VLM usage=No, Query source=Original2025.05 | 21.3 | 16.4 |