ResearchDatasetsHuman evaluationsFollowBenchmarksTask NameDataset NameSOTA MethodSortMost resultsRecently updatedMost papersApplyTask NameDataset NameSOTA ResultTrendResultsEmbodied vision-language reasoningHuman evaluations H0.879Score13