Reinforcement Learning on obstacle4 non-convex
33.4ReturnPPO-Lag
Evaluation Results
| Method | Links | ||
|---|---|---|---|
| PPO-Lag2026.02 | 33.4 | 0 | |
| A2C-GP-Shield2026.02 | 15.5 | 100 | |
| DMPS2026.02 | 11.3 | 100 | |
| CPO2026.02 | 8.56 | 92.4 | |
| MPS2026.02 | -1.12 | 100 |
| Method | Links | ||
|---|---|---|---|
| PPO-Lag2026.02 | 33.4 | 0 | |
| A2C-GP-Shield2026.02 | 15.5 | 100 | |
| DMPS2026.02 | 11.3 | 100 | |
| CPO2026.02 | 8.56 | 92.4 | |
| MPS2026.02 | -1.12 | 100 |