ResearchBenchmarksReinforcement Learning on Delayed MuJoCo Hopper v2 (test)Follow3,435.28Max ReturnDE-MME2,036.85442,399.90722,762.963,126.0128Jun 19, 2021Evaluation ResultsMethodMethodLinksMax ReturnDE-MME2021.063,435.28DAC2021.063,428.18MME2021.063,421.32MaxEnt(State)2021.063,254.1RND2021.062,721.06SAC-Div2021.062,090.64