ResearchDatasetspretraining corpusFollowBenchmarksTask NameDataset NameSOTA MethodSortMost resultsRecently updatedMost papersApplyTask NameDataset NameSOTA ResultTrendResultsLanguage Modeling20B token pretraining corpus2.756PT Train Loss2