ResearchBenchmarksReinforcement Learning on AntFollow960.57Average DecisionsTD3732.446791.6705850.895910.1195May 30, 2023Evaluation ResultsMethodMethodLinksAverage DecisionsAverage MMACsTD32023.05960.57160.22TLA2023.05860.21243.22TempoRL2023.05741.22248.53