Multi-agent Reinforcement Learning on MaMuJoCo OMIGA 6-HalfCheetah (Expert)
5,545Average Episode RewardOMSD
Evaluation Results
| Method | Links | |
|---|---|---|
| OMSD2025.05 | 5,545 | |
| Sim2OSteps=1 million2026.06 | 5,073.96 | |
| AWAC-MASteps=1 million2026.06 | 4,958.51 | |
| PEX-MASteps=1 million2026.06 | 4,779.57 | |
| PROTO-MASteps=1 million2026.06 | 3,611.6 | |
| OMIGA2025.05 | 3,383.61 | |
| RLPD-MASteps=1 million2026.06 | 3,379.37 | |
| BCQMA2025.05 | 2,992.71 | |
| ICQ2025.05 | 2,955.94 | |
| CQLMA2025.05 | 1,189.54 | |
| OMAR2025.05 | -206.73 |