ResearchBenchmarksReinforcement Learning on Hopper (forward)Follow982Average Episodic ReturnCOMBO430.8573.9717860.1Mar 10, 2024Evaluation ResultsMethodMethodLinksAverage Episodic ReturnCOMBO2024.03982DiSPO2024.03832MOPO2024.03753USFA2024.03746FB2024.03726COMBO2024.03670RaMP2024.03652DiSPO2024.03566MOPO2024.03493USFA2024.03487RaMP2024.03470FB2024.03452