Multi-Agent Reinforcement Learning on MAMuJoCo HalfCheetah Extreme Env v2 (various)
2,757.2Average ReturnMA-SfBC
Evaluation Results
| Method | Links | |
|---|---|---|
| MA-SfBCDataset Split=Expert2023.07 | 2,757.2 | |
| DOM2Dataset Split=Expert2023.07 | 2,641.3 | |
| DOM2Dataset Split=Medium2023.07 | 2,232.4 | |
| DOM2Dataset Split=Medium Expert2023.07 | 2,219 | |
| OMARDataset Split=Medium2023.07 | 2,197.4 | |
| OMARDataset Split=Medium Expert2023.07 | 2,196.9 | |
| MA-CQLDataset Split=Expert2023.07 | 2,117 | |
| DOM2Dataset Split=Medium Replay2023.07 | 1,904.2 | |
| OMARDataset Split=Expert2023.07 | 1,615.7 | |
| OMARDataset Split=Medium Replay2023.07 | 1,549.9 | |
| MA-SfBCDataset Split=Medium Expert2023.07 | 1,393.7 | |
| MA-SfBCDataset Split=Medium2023.07 | 1,355 | |
| MA-CQLDataset Split=Medium Replay2023.07 | 1,290.4 | |
| MA-CQLDataset Split=Medium Expert2023.07 | 1,127.1 | |
| MA-CQLDataset Split=Medium2023.07 | 1,108.1 | |
| DOM2Dataset Split=Random Medium2023.07 | 482 | |
| DOM2Dataset Split=Random2023.07 | 372.9 | |
| OMARDataset Split=Random Medium2023.07 | 129.8 | |
| MA-CQLDataset Split=Random2023.07 | -0.1 | |
| MA-CQLDataset Split=Random Medium2023.07 | -0.1 | |
| OMARDataset Split=Random2023.07 | -1 | |
| MA-SfBCDataset Split=Medium Replay2023.07 | -169.8 | |
| MA-SfBCDataset Split=Random2023.07 | -309.8 | |
| MA-SfBCDataset Split=Random Medium2023.07 | -329.2 |