ResearchBenchmarksFunction Optimization on DejongFollow-0Average Maximum RewardGI-PPO-0.000054-0.00004-0.000026-0.000012Dec 14, 2023Evaluation ResultsMethodMethodLinksAverage Maximum RewardGI-PPO2023.12-0RP2023.12-0LR+RP2023.12-0LR2023.12-0PPO2023.12-0.0001