ResearchDatasetsLinear Mixture MDPFollowBenchmarksTask NameDataset NameSOTA MethodSortMost resultsRecently updatedMost papersApplyTask NameDataset NameSOTA ResultTrendResultsSafe Reinforcement LearningLinear Mixture MDP inhomogeneous, episodic B-bounded2Regret2