ResearchBenchmarksOffline Multi-Agent Reinforcement Learning on SMAC Marine-Hard Medium-ReplayFollow81.9Win Rate (3m)ODIS38.32449.63760.9572.263Mar 12, 2026Evaluation ResultsMethodMethodLinksWin Rate (3m)Win Rate (5m vs 6m)Win Rate (9m vs 10m)Win Rate (4m)Win Rate (5m)Win Rate (10m)Win Rate (12m)Win Rate (7m vs 8m)Win Rate (8m vs 9m)Win Rate (10m vs 11m)Win Rate (10m vs 12m)Win Rate (13m vs 15m)Average Win RateODIS2026.0381.911.91559.455.651.951.38.13.112.501.329.3STAIRS2026.0378.150.678.193.810097.594.423.126.966.93.14.459.7HiSSD2026.0375.624.44571.971.393.191.912.511.333.806.344.8UPDeT-m2026.034000.646.364.429.425.60.60.60.60017.3