ResearchDatasetsSepsis MDPFollowBenchmarksTask NameDataset NameSOTA MethodSortMost resultsRecently updatedMost papersApplyTask NameDataset NameSOTA ResultTrendResultsOffline Policy EvaluationSepsis-MDP (test)0.171MSE8Offline Reinforcement LearningSepsis MDP n=200-1.94Average True Return6