Multi-agent Reinforcement Learning on MaMuJoCo (OMIGA) 6-HalfCheetah Medium
4,695Average Episode RewardOMSD
Evaluation Results
| Method | Links | |
|---|---|---|
| OMSD2025.05 | 4,695 | |
| OMIGA2025.05 | 3,608.13 | |
| Sim2OSteps=1 million2026.06 | 3,543.84 | |
| AWAC-MASteps=1 million2026.06 | 3,367.92 | |
| PEX-MASteps=1 million2026.06 | 3,069.09 | |
| RLPD-MASteps=1 million2026.06 | 2,792.85 | |
| PROTO-MASteps=1 million2026.06 | 2,752.22 | |
| BCQMA2025.05 | 2,590.47 | |
| ICQ2025.05 | 2,549.27 | |
| CQLMA2025.05 | 1,011.35 | |
| OMAR2025.05 | -265.68 |