NarrativeQA
Benchmarks
Task NameDataset NameSOTA ResultTrendResults
NarrativeQA
38.12F1 Score
124
NarrativeQA (test)
76.2ROUGE-L
88
NarrativeQA
21.96Score
40
NarrativeQA
15EM
38
NarrativeQA
53.56F1 Score
38
NarrativeQA
22SubEM
36
NarrativeQA
33.61F1
36
NarrativeQA LongBench
15.92F1 Score
29
NarrativeQA
21.5BLEU-1
28
NarrativeQA
23.89Score
22
NarrativeQA Passage Split
32.64Score
18
NarrativeQA Fixed Chunk 2048
32.64Score
18
NarrativeQA
34.79EM
18
NarrativeQA No Trun. latest (test)
23.96Average Score
18
NarrativeQA
28.94F1 Score
16
NarrativeQA
45Rouge-L
15
NarrativeQA
26.6F1 Score
14
NarrativeQA
55Accuracy
14
NarrativeQA
98Precision
13
NarrativeQA
355.12TTFT (ms)
12
NarrativeQA
0.58Peak GPU Memory (GB)
12
NarrativeQA LongBench 32K context
17.2F1 Score
12
NarrativeQA (test)
38.4F1 Score
12
NarrativeQA (test)
61.7nDCG@10
12
NarrativeQA LongEmbed
71.5nDCG@10
11