ResearchDatasetsA2EvalFollowBenchmarksTask NameDataset NameSOTA MethodSortMost resultsRecently updatedMost papersApplyTask NameDataset NameSOTA ResultTrendResultsEmbodied vision-language reasoningA2Eval B~65.97Score13