ResearchBenchmarks3D Visual Question Answering on 3DMV-VQA (single room subset)Follow70.2Concept AccuracyScene-LLM69.88869.96970.0570.131Mar 18, 2024Evaluation ResultsMethodMethodLinksConcept AccuracyCounting AccuracyRelation AccuracyComparison AccuracyOverall AccuracyScene-LLMEvaluation Protocol=ta...Evaluation Protocol=task-specific tuning (tt)2024.0370.233.562.475.161.3Scene-LLMEvaluation Protocol=ze...Evaluation Protocol=zero-shot (zs)2024.0369.931.26273.559.6