Lifelong Multi-agent Pathfinding on Lifelong MAPF Map (train)
2,248.71Cumulative Original RewardIPPO (ARMS)
Evaluation Results
| Method | Links | |
|---|---|---|
| IPPO (ARMS)Agent Count=16, Reward Sparsity=10, Base RL Algorithm=IPPO2026.05 | 2,248.71 | |
| IPPO (ARMS)Agent Count=16, Reward Sparsity=20, Base RL Algorithm=IPPO2026.05 | 2,155.95 | |
| IPPO (ARMS)Agent Count=8, Reward Sparsity=20, Base RL Algorithm=IPPO2026.05 | 2,116.54 | |
| IPPO (ARMS)Agent Count=32, Reward Sparsity=20, Base RL Algorithm=IPPO2026.05 | 2,071.69 | |
| IPPO (ARMS)Agent Count=16, Reward Sparsity=30, Base RL Algorithm=IPPO2026.05 | 1,799.66 | |
| IPPO (No shaping)Agent Count=16, Reward Sparsity=10, Base RL Algorithm=IPPO2026.05 | 1,619.27 | |
| IPPO (PBRS)Agent Count=16, Reward Sparsity=10, Base RL Algorithm=IPPO2026.05 | 1,600.68 | |
| IPPO (PBRS)Agent Count=8, Reward Sparsity=20, Base RL Algorithm=IPPO2026.05 | 1,413.82 | |
| IPPO (PBRS)Agent Count=16, Reward Sparsity=20, Base RL Algorithm=IPPO2026.05 | 1,306.5 | |
| IPPO (No shaping)Agent Count=16, Reward Sparsity=20, Base RL Algorithm=IPPO2026.05 | 1,212.87 | |
| IPPO (No shaping)Agent Count=8, Reward Sparsity=20, Base RL Algorithm=IPPO2026.05 | 1,114.58 | |
| IPPO (PBRS)Agent Count=32, Reward Sparsity=20, Base RL Algorithm=IPPO2026.05 | 1,076.61 | |
| IPPO (No shaping)Agent Count=32, Reward Sparsity=20, Base RL Algorithm=IPPO2026.05 | 1,022.83 | |
| IPPO (PBRS)Agent Count=16, Reward Sparsity=30, Base RL Algorithm=IPPO2026.05 | 904.65 | |
| IPPO (No shaping)Agent Count=16, Reward Sparsity=30, Base RL Algorithm=IPPO2026.05 | 762.55 |