ResearchDatasetsCMDPsFollowBenchmarksTask NameDataset NameSOTA MethodSortMost resultsRecently updatedMost papersApplyTask NameDataset NameSOTA ResultTrendResultsLast-iterate convergenceCMDPs2Sample Complexity7Learning an epsilon-optimal policy with safe explorationInfinite-horizon Discounted Constrained Markov Decision Processes (CMDPs)—Primary metric0
Learning an epsilon-optimal policy with safe explorationInfinite-horizon Discounted Constrained Markov Decision Processes (CMDPs)—Primary metric0