Multiple Object Grounding on Reasoning Segmentation Long query
49.2gIoULISA
Evaluation Results
| Method | Links | ||
|---|---|---|---|
| LISATraining paradigm=Train LLaVA 1.5-7B, Query source=Original2025.05 | 49.2 | 48.9 | |
| TextRegionQuery source=Interpreted from LLaVA 1.5-7B2025.05 | 47.2 | 45.3 | |
| OVSegQuery source=Interpreted from LLaVA 1.5-7B2025.05 | 44.6 | 37.1 | |
| TridentQuery source=Interpreted from LLaVA 1.5-7B2025.05 | 43.3 | 42.5 | |
| OVSegTraining paradigm=Training-based, VLM usage=No, Query source=Original2025.05 | 28.7 | 22.5 | |
| TextRegionTraining paradigm=Training-free, VLM usage=No, Query source=Original2025.05 | 26.4 | 24.1 | |
| SEEMTraining paradigm=Training-based, VLM usage=No, Query source=Original2025.05 | 25.6 | 20.8 | |
| TridentTraining paradigm=Training-free, VLM usage=No, Query source=Original2025.05 | 24.5 | 23.1 | |
| Grounded-SAMTraining paradigm=Training-based, VLM usage=No, Query source=Original2025.05 | 22.4 | 18.6 | |
| X-DecoderTraining paradigm=Training-based, VLM usage=No, Query source=Original2025.05 | 22.2 | 17.5 |