State Prediction on TD-MPC2 policy dataset Acrobot
0.0121MSEMoSim
Evaluation Results
| Method | Links | |
|---|---|---|
| MoSimTraining Data Source=random policy data, Horizon=162025.04 | 0.0121 | |
| MoSimTraining Data Source=random policy data, Horizon=1002025.04 | 1.2864 | |
| DreamerV3Training Data Source=experience data, Prediction Steps=5-step, Horizon=162025.04 | 1.39 | |
| DreamerV3Training Data Source=random policy data, Prediction Steps=5-step, Horizon=162025.04 | 1.39 | |
| DreamerV3Training Data Source=experience data, Prediction Steps=1-step, Horizon=162025.04 | 5.0681 | |
| DreamerV3Training Data Source=random policy data, Prediction Steps=1-step, Horizon=162025.04 | 5.0681 | |
| DreamerV3Training Data Source=experience data, Prediction Steps=5-step, Horizon=1002025.04 | 11.1576 | |
| DreamerV3Training Data Source=random policy data, Prediction Steps=5-step, Horizon=1002025.04 | 11.1576 | |
| DreamerV3Training Data Source=experience data, Prediction Steps=1-step, Horizon=1002025.04 | 16.8498 | |
| DreamerV3Training Data Source=random policy data, Prediction Steps=1-step, Horizon=1002025.04 | 16.8498 |