ResearchBenchmarksOffline Reinforcement Learning on D4RL maze2d-umaze sparseFollow139.5Normalized ScoreROMI-BCQ-20.97220.68962.35104.011Oct 1, 2021Evaluation ResultsMethodMethodLinksNormalized ScoreROMI-BCQ2021.10139.5COMBO2021.1076.4BEAR2021.1065.7ROMI-CQL2021.1054.3BCQ2021.1049.1BAIL2021.1044.7CQL2021.1018.9BRAC-v2021.108.7BC2021.10-3.2BRAC-P2021.10-9.2Repb-SDE2021.10-12.3MOREL2021.10-14.4MOPO2021.10-14.8