ResearchDatasetsRandom targetsFollowBenchmarksTask NameDataset NameSOTA MethodSortMost resultsRecently updatedMost papersApplyTask NameDataset NameSOTA ResultTrendResultsToken-forcing loss optimizationRandom targets Held-out (val)0.27Qwen-2.5-7B Loss56