ResearchDatasetsHangmanFollowBenchmarksTask NameDataset NameSOTA MethodSortMost resultsRecently updatedMost papersApplyTask NameDataset NameSOTA ResultTrendResultsReinforcement LearningHangman OOD-16.84Cumulative Reward3In-context adaptationHangman6.48Cumulative Reward3Reinforcement LearningHangman (OOD-2)5.65Cumulative Reward2