Stacking Puzzle on Real-Robot
56Success RateBPP
Evaluation Results
| Method | Links | |
|---|---|---|
| BPPPolicy Architecture=Diffusion Transformer, Training Objective=DDPM, Action Chunking=50, History Conditioning=Big Picture Policies2026.02 | 56 | |
| PTPPolicy Architecture=Diffusion Transformer, Training Objective=DDPM, Action Chunking=50, History Conditioning=Past-Token Prediction2026.02 | 52 | |
| Naïve HistoryPolicy Architecture=Diffusion Transformer, Training Objective=DDPM, Action Chunking=50, History Conditioning=Naïve History2026.02 | 21 | |
| Current ObsPolicy Architecture=Diffusion Transformer, Training Objective=DDPM, Action Chunking=50, History Conditioning=Current Observation2026.02 | 6.5 |