Multi-Agent Reinforcement Learning on MAMuJoCo HalfCheetah Standard Env v2 (various)
3,676.6Average ReturnDOM2
Evaluation Results
| Method | Links | |
|---|---|---|
| DOM2Dataset Split=Expert2023.07 | 3,676.6 | |
| OMARDataset Split=Expert2023.07 | 2,963.8 | |
| DOM2Dataset Split=Medium Expert2023.07 | 2,919.6 | |
| OMARDataset Split=Medium Expert2023.07 | 2,900.2 | |
| DOM2Dataset Split=Medium2023.07 | 2,851.2 | |
| OMARDataset Split=Medium2023.07 | 2,797 | |
| MA-CQLDataset Split=Expert2023.07 | 2,722.8 | |
| DOM2Dataset Split=Medium Replay2023.07 | 2,564.3 | |
| MA-SfBCDataset Split=Expert2023.07 | 2,386.6 | |
| MA-CQLDataset Split=Medium Expert2023.07 | 1,989.8 | |
| OMARDataset Split=Medium Replay2023.07 | 1,674.8 | |
| MA-SfBCDataset Split=Medium Expert2023.07 | 1,392.3 | |
| MA-SfBCDataset Split=Medium2023.07 | 1,386.8 | |
| MA-CQLDataset Split=Medium Replay2023.07 | 1,216.6 | |
| MA-CQLDataset Split=Medium2023.07 | 963.4 | |
| DOM2Dataset Split=Random Medium2023.07 | 875 | |
| DOM2Dataset Split=Random2023.07 | 799.8 | |
| OMARDataset Split=Random Medium2023.07 | 219.5 | |
| MA-CQLDataset Split=Random2023.07 | -0.1 | |
| MA-CQLDataset Split=Random Medium2023.07 | -0.1 | |
| OMARDataset Split=Random2023.07 | -0.9 | |
| MA-SfBCDataset Split=Medium Replay2023.07 | -128.3 | |
| MA-SfBCDataset Split=Random Medium2023.07 | -383.1 | |
| MA-SfBCDataset Split=Random2023.07 | -388.9 |