ResearchDatasetsStudent-t reward scenarioFollowBenchmarksTask NameDataset NameSOTA MethodSortMost resultsRecently updatedMost papersApplyTask NameDataset NameSOTA ResultTrendResultsBandit Interval Coverage and Width EvaluationStudent-t reward scenario (Delta = 0.5) synthetic (1,000 MC replicates)81.29Coverage Arm16
Bandit Interval Coverage and Width EvaluationStudent-t reward scenario (Delta = 0.5) synthetic (1,000 MC replicates)81.29Coverage Arm16