NarrativeQA
Benchmarks
Task NameDataset NameSOTA ResultTrendResults
NarrativeQA
86ASR
11
NarrativeQA
61.7Exact Match
11
NarrativeQA
6.804Overall Score
10
NarrativeQA
40.28F1 Score
10
NarrativeQA LongBench
96Precision
10
NarrativeQA
53.35F1 Score
9
NarrativeQA
58.08Ragas Answer Relevance
9
NarrativeQA Helmet benchmark
49.5F1 Score
9
NarrativeQA Trun. latest (test)
21.34Average Score
9
NarrativeQA
29.11Recall@3
8
NarrativeQA (test)
54.11BLEU-1
8
NarrativeQA summaries
36.55BLEU-1
8
NarrativeQA
73.77Accuracy
7
NarrativeQA
59.5R@10
6
NarrativeQA
84Precision
6
NarrativeQA
24,686.84Prefill Throughput (tok/s)
6
NarrativeQA
2.1End-to-End Latency
6
NarrativeQA summaries (test)
43.63BLEU-1
6
NarrativeQA Story Summaries (val)
52.78BLEU-1
6
NarrativeQA novel-to-video adaptation setting
4.26CBC
5
NarrativeQA
62.2Exact Match (EM)
5
NarrativeQA
25.39BLEU
5
NarrativeQA
32.6F1 Score
5
NarrativeQA
40.58KB Construction Time
5
NarrativeQA
12.47F1 Score
5