ResearchDatasetsFDAFollowBenchmarksTask NameDataset NameSOTA MethodSortMost resultsRecently updatedMost papersApplyTask NameDataset NameSOTA ResultTrendResultsLong-context language modeling evaluationFDA (test)0.8Score120Information ExtractionFDA84.5Accuracy22Dynamic Multi-objective OptimizationFDA 22Maximum Hypervolume (MHV)15In-context retrievalFDA74.5Accuracy13Knowledge-style RetrievalFDA 2048 tokens62Accuracy8Information Extraction and RetrievalFDA2.72Accuracy5