ResearchBenchmarksRegret minimization in Reinforcement Learning on Linear MDPFollow4RegretDOERL3.83.944.1May 1, 2026Evaluation ResultsMethodMethodLinksRegretEstimation Oracle CallsPlanning Oracle CallsDOERLEstimation oracle type...Estimation oracle type=offline2026.054——