Safe Offline Multi-Agent Reinforcement Learning on 2halfcheetah medium
0.51RewardMA-TD3BC
Evaluation Results
| Method | Links | ||
|---|---|---|---|
| MA-TD3BC2026.06 | 0.51 | 1.58 | |
| CBFs-Guided Diffusion Model2026.06 | 0.43 | 0.48 | |
| OMAR2026.06 | 0.25 | 1.51 |
| Method | Links | ||
|---|---|---|---|
| MA-TD3BC2026.06 | 0.51 | 1.58 | |
| CBFs-Guided Diffusion Model2026.06 | 0.43 | 0.48 | |
| OMAR2026.06 | 0.25 | 1.51 |