Reinforcement Learning on Gymnasium Reacher
-3.57ReturnSAC Base
Evaluation Results
| Method | Links | ||
|---|---|---|---|
| SAC BaseRL Algorithm=SAC2026.01 | -3.57 | 0.051 | |
| CAPSRL Algorithm=SAC2026.01 | -3.57 | 0.046 | |
| L2C2RL Algorithm=SAC2026.01 | -3.57 | 0.051 | |
| ASAPRL Algorithm=SAC2026.01 | -3.61 | 0.045 | |
| GRADRL Algorithm=SAC2026.01 | -3.62 | 0.043 | |
| L2C2Base RL Algorithm=PPO2026.01 | -4.67 | 0.039 | |
| CAPSBase RL Algorithm=PPO2026.01 | -5.2 | 0.028 | |
| ASAPBase RL Algorithm=PPO2026.01 | -5.44 | 0.028 | |
| GRADBase RL Algorithm=PPO2026.01 | -5.48 | 0.031 | |
| PPO BaseBase RL Algorithm=PPO2026.01 | -5.67 | 0.034 |