ResearchDatasetsTransformer Sparse Attention WorkloadFollowBenchmarksTask NameDataset NameSOTA MethodSortMost resultsRecently updatedMost papersApplyTask NameDataset NameSOTA ResultTrendResultsSparse Attention AccelerationTransformer Sparse Attention Workload0.1Accuracy Loss (Sparse Attn)3