ResearchBenchmarksReinforcement Learning on Solaris (test)Follow11.61Avg Cumulative RewardSND-STD3.52925.62717.7259.8229Feb 22, 2023Evaluation ResultsMethodMethodLinksAvg Cumulative RewardSND-STD2023.0211.61SND-VIC2023.0210.85Baseline2023.028.08SND-V2023.023.96RND2023.023.84