ResearchBenchmarksReinforcement Learning on Walker fixed linear adversaryFollow5,256Average PerformanceTC-M2TD31,352.882,366.193,379.54,392.81Jun 12, 2024Evaluation ResultsMethodMethodLinksAverage PerformanceTC-M2TD3Stacked=trueStacked=true2024.065,256TC-M2TD3Oracle=trueOracle=true2024.064,952TC-M2TD32024.064,844TC-RARLOracle=trueOracle=true2024.064,613M2TD3Oracle=trueOracle=true2024.064,431DR2024.064,307TC-RARLStacked=trueStacked=true2024.064,234M2TD32024.064,128TC-RARL2024.063,906TD32024.062,396RARL2024.061,894RARLOracle=trueOracle=true2024.061,503