ResearchBenchmarksMulti-task Reinforcement Learning on DmLab-30 (train)Follow0.735Mean capped human normalised scorePopArt-IMPALA0.600840.635670.67050.70533Sep 12, 2018Evaluation ResultsMethodMethodLinksMean capped human normalised scorePopArt-IMPALA2018.090.735IMPALA2018.090.606