ResearchBenchmarksReinforcement Learning on MuJoCo HalfCheetah Sparse v2 (test)Follow924.9Max Average ReturnDE-MME373.492516.646659.8802.954Jun 19, 2021Evaluation ResultsMethodMethodLinksMax Average ReturnDE-MME2021.06924.9MaxEnt(State)2021.06924.7DAC2021.06915.9MME2021.06903.5RND2021.06827.8SAC-Div2021.06394.7