ResearchDatasetsSkew-t reward scenarioFollowBenchmarksTask NameDataset NameSOTA MethodSortMost resultsRecently updatedMost papersApplyTask NameDataset NameSOTA ResultTrendResultsBandit Interval Coverage and Width EvaluationSkew-t reward scenario Delta = 0.5 synthetic (1,000 MC replicates)80.3Coverage Arm16
Bandit Interval Coverage and Width EvaluationSkew-t reward scenario Delta = 0.5 synthetic (1,000 MC replicates)80.3Coverage Arm16