ResearchDatasetsMedium-scale corpusFollowBenchmarksTask NameDataset NameSOTA MethodSortMost resultsRecently updatedMost papersApplyTask NameDataset NameSOTA ResultTrendResultsMulti-hop Question AnsweringMedium-scale corpus Average80.7Average Judge Score5