ResearchBenchmarksReinforcement Learning on ST-road2dFollow24Mean ScoreDMPS10.68814.14417.621.056May 22, 2024Evaluation ResultsMethodMethodLinksMean ScoreStandard DeviationDMPS2024.05240.2MPS2024.05240.2CPO2024.05240PPO-Lag2024.05240.1TD32024.05240.1REVEL2024.0511.216.5