ResearchDatasetsthe RoomFollowBenchmarksTask NameDataset NameSOTA MethodSortMost resultsRecently updatedMost papersApplyTask NameDataset NameSOTA ResultTrendResultsReinforcement Learningthe Room (test)128Average Total Reward per Episode30