Off-Policy Evaluation on PenDigits (UCI)
0.0008MSEMR
Evaluation Results
| Method | Links | |
|---|---|---|
| MRnumber of evaluation data (n)=1000, number of training data (m)=500, alpha* (target policy parameter)=0.62023.12 | 0.0008 | |
| DRosnumber of evaluation data (n)=1000, number of training data (m)=500, alpha* (target policy parameter)=0.62023.12 | 0.0138 | |
| SwitchDRnumber of evaluation data (n)=1000, number of training data (m)=500, alpha* (target policy parameter)=0.62023.12 | 0.0342 | |
| DMnumber of evaluation data (n)=1000, number of training data (m)=500, alpha* (target policy parameter)=0.62023.12 | 0.052 | |
| IPWnumber of evaluation data (n)=1000, number of training data (m)=500, alpha* (target policy parameter)=0.62023.12 | 0.1342 | |
| DRnumber of evaluation data (n)=1000, number of training data (m)=500, alpha* (target policy parameter)=0.62023.12 | 0.2343 |