ResearchBenchmarksReinforcement Learning on ST-obstacle2Follow34.1Mean ScorePPO-Lag-3.2366.45716.1525.843May 22, 2024Evaluation ResultsMethodMethodLinksMean ScoreStd Dev ScorePPO-Lag2024.0534.10.1CPO2024.05330.2DMPS2024.0520.215.2REVEL2024.059.321.1TD32024.05-1.23MPS2024.05-1.83.2