ResearchDatasetsMarkov Decision ProcessFollowBenchmarksTask NameDataset NameSOTA MethodSortMost resultsRecently updatedMost papersApplyTask NameDataset NameSOTA ResultTrendResultsReinforcement LearningMarkov Decision Process (MDP)1Sample Complexity10Epsilon-optimal Policy IdentificationAverage-reward Markov Decision Process (AMDP)—Primary metric0