ResearchDatasetsGeneral Generation WorkloadFollowBenchmarksTask NameDataset NameSOTA MethodSortMost resultsRecently updatedMost papersApplyTask NameDataset NameSOTA ResultTrendResultsText GenerationGeneral Generation Workload inference latency 1000 tokens72.51Prefill Latency (ms)3