Multi-Agent Reinforcement Learning on MPE Predator Prey (Random)
208.7Mean Episode ReturnDOM2
Evaluation Results
| Method | Links | |
|---|---|---|
| DOM22023.07 | 208.7 | |
| CFCQL2023.07 | 144.8 | |
| DOM22023.07 | 120.7 | |
| MA-Diffusion-QL2023.07 | 82.2 | |
| MA-EDP-DPM-Solver2023.07 | 64.3 | |
| MA-BRAC2023.07 | 29.9 | |
| DoF2023.07 | 24 | |
| OMAC2023.07 | 19.8 | |
| OMAR2023.07 | 10.4 | |
| MA-SfBC2023.07 | 9.3 | |
| MA-EDP-DDPM2023.07 | 8.8 | |
| MA-IQL2023.07 | 3 | |
| MADIFF2023.07 | 2 | |
| MA-CQL2023.07 | 1.8 | |
| OMIGA2023.07 | -2 |