ResearchDatasetsMLGymFollowBenchmarksTask NameDataset NameSOTA MethodSortMost resultsRecently updatedMost papersApplyTask NameDataset NameSOTA ResultTrendResultsReinforcement LearningMLGym Breakout100Reward7Decision MakingMLGym Prisoner's Dilemma3Payoff7Decision MakingMLGym Battle of Sexes2Payoff7Language ModelingMLGym Language Modeling3.5Loss7Natural Language InferenceMLGym MNLI92.5Accuracy7Tabular RegressionMLGym House Price0.99R27