Word Prediction on LAMBADA CONTROL (all)
36AccuracyHuman
Evaluation Results
| Method | Links | |
|---|---|---|
| Humanestimation_source=100 randomly-sampled CONTROL instances2016.10 | 36 | |
| LSTMbaseline_category=Paperno et al. (2016)2016.10 | 21.9 | |
| n-grambaseline_category=Paperno et al. (2016)2016.10 | 19.1 | |
| n-gram + cachebaseline_category=Paperno et al. (2016)2016.10 | 19.1 | |
| GA Reader + featuresfeatures=Wang et al. (2016)2016.10 | 9.3 | |
| GA Reader2016.10 | 8.8 | |
| AS Reader + featuresfeatures=Wang et al. (2016)2016.10 | 8.6 | |
| Memory networkbaseline_category=Paperno et al. (2016)2016.10 | 8.5 | |
| AS Reader2016.10 | 8.5 | |
| Modified Stanford Reader2016.10 | 7.4 | |
| Stanford Reader2016.10 | 7 | |
| LSTMbaseline_category=Context-restricted language model2016.10 | 2.4 | |
| n-grambaseline_category=Context-restricted language model2016.10 | 2.2 | |
| n-gram + cachebaseline_category=Context-restricted language model2016.10 | 2.2 | |
| Lastbaseline_category=Context-restricted non-stopword2016.10 | 0.9 | |
| Most frequentbaseline_category=Context-restricted non-stopword2016.10 | 0.4 | |
| Randombaseline_category=Context-restricted non-stopword2016.10 | 0.3 | |
| Firstbaseline_category=Context-restricted non-stopword2016.10 | 0.1 | |
| Random in contextbaseline_category=Paperno et al. (2016)2016.10 | 0 | |
| Random cap. in contextbaseline_category=Paperno et al. (2016)2016.10 | 0 |