SemEval Task 9
Benchmarks
Task NameDataset NameSOTA ResultTrendResults
SemEval Task 9 English general-purpose subtask 2018 (gold standard evaluation)
0.544MRR
18
SemEval-2026 Task 9 urd (test)
78.3Accuracy
1
SemEval-2026 Task 9 rus (test)
82Accuracy
1
SemEval-2026 Task 9 khm (test)
92.7Accuracy
1
SemEval Task 9 ita 2026 (test)
63Accuracy
1
SemEval Task 9 hau 2026 (test)
93.1Accuracy
1
SemEval Task 9 deu 2026 (test)
71.1Accuracy
1
SemEval Task 9 eng 2026 (test)
81Accuracy
1
SemEval-2026 Task 9 zho (test)
89.1Accuracy
1