Object-level reasoning on UNOBench Hard synthetic (test)
67.6OPGemini Robotics-ER 1.5
Evaluation Results
| Method | Links | |||
|---|---|---|---|---|
| Gemini Robotics-ER 1.5Prompting Strategy=Oracle (with SoM), Evaluation Mode=In-Context Learning (ICL)2025.11 | 67.6 | 24.3 | 33 | |
| UNOGraspPrompting Strategy=Oracle (with SoM)2025.11 | 63 | 43.6 | 48.7 | |
| Gemini Robotics-ER 1.5Prompting Strategy=Oracle (with SoM), Evaluation Mode=Base Prompting2025.11 | 46.1 | 14.4 | 20.8 | |
| UNOGraspPrompting Strategy=Natural Language Prompting2025.11 | 44.6 | 20.1 | 25.7 | |
| Qwen2.5-VLPrompting Strategy=Oracle (with SoM), Evaluation Mode=In-Context Learning (ICL)2025.11 | 13.9 | 10.8 | 10.6 | |
| Gemini Robotics-ER 1.5Prompting Strategy=Natural Language Prompting, Evaluation Mode=Base Prompting2025.11 | 7.8 | 2 | 3.1 | |
| Gemini Robotics-ER 1.5Prompting Strategy=Natural Language Prompting, Evaluation Mode=In-Context Learning (ICL)2025.11 | 6.1 | 1.7 | 2.6 | |
| Qwen2.5-VLPrompting Strategy=Natural Language Prompting, Evaluation Mode=In-Context Learning (ICL)2025.11 | 3.7 | 2.2 | 2.7 |