ResearchDatasetsRandomworldsFollowBenchmarksTask NameDataset NameSOTA MethodSortMost resultsRecently updatedMost papersApplyTask NameDataset NameSOTA ResultTrendResultsInverse Transition LearningRandomworlds76Epsilon Matching5Inverse Transition LearningRandomworlds 40% stochastic-policy states76Epsilon Matching5