ResearchBenchmarksSequential Decision Making on 50 simulated datasets T=10Follow0.697Mean RegretSUPER0.655680.934591.21351.49241Sep 29, 2022Evaluation ResultsMethodMethodLinksMean RegretStandard DeviationSUPERPolicy Class=SUPER, n=...Policy Class=SUPER, n=20002022.090.6970.151COMMONPolicy Class=COMMON, n...Policy Class=COMMON, n=20002022.091.730.261