Named Entity Recognition on GENIA
83.8F1 ScoreBERT-MRC
Evaluation Results
| Method | Links | |
|---|---|---|
| BERT-MRCTraining Setting=standard2021.01 | 83.8 | |
| State-of-the-art2022.04 | 81.39 | |
| DEEPSTRUCTmode=w/ finetune2022.05 | 80.8 | |
| DEEPSTRUCTEvaluation Protocol=w/ finetune2022.05 | 80.8 | |
| Yu et al., 2020b2022.05 | 80.5 | |
| BiaffineLSTM2022.05 | 80.5 | |
| DEEPSTRUCTmode=multi-task2022.05 | 80.2 | |
| DEEPSTRUCTEvaluation Protocol=multi-task2022.05 | 80.2 | |
| BioBART LARGESize=Large2022.04 | 79.93 | |
| KnowCoder-XEvaluation Protocol=Supervised2024.11 | 78.97 | |
| BART LARGESize=Large2022.04 | 78.93 | |
| GLiNEREvaluation Protocol=Supervised2026.04 | 78.9 | |
| BioBART BASESize=Base2022.04 | 78.43 | |
| BART BASESize=Base2022.04 | 78.06 | |
| UniNER-7BEvaluation Protocol=Supervised2026.04 | 77.5 | |
| KnowCoder-7BEvaluation Protocol=Supervised2026.04 | 76.7 | |
| IEPILEEvaluation Protocol=Supervised2024.11 | 76.66 | |
| B2NEREvaluation Protocol=Supervised2024.11 | 76.43 | |
| TANLTraining Setting=standard2021.01 | 76.4 | |
| TANLTraining Setting=multi-task2021.01 | 76.4 | |
| TANL2022.05 | 76.4 | |
| TANL2022.05 | 76.4 | |
| TANLEvaluation Protocol=multitask2022.05 | 76.4 | |
| B2NEREvaluation Protocol=Supervised2026.04 | 76.4 | |
| TANLTraining Setting=multi-dataset2021.01 | 75.9 | |
| InstructUIEEvaluation Protocol=Supervised2026.04 | 75.7 | |
| YAYI-UIEEvaluation Protocol=Supervised2024.11 | 75.21 | |
| Ju et al.2018.10 | 74.7 | |
| Neural Transition-based Modelw/s=14452018.10 | 73.9 | |
| Katiyar and Cardie2018.10 | 73.6 | |
| BERTEvaluation Protocol=Supervised2024.11 | 73.3 | |
| BERT-baseEvaluation Protocol=Supervised2026.04 | 73.3 | |
| Neural Transition-based Model (w/o dropout layer)w/s=14402018.10 | 72.7 | |
| Neural Transition-based Model (w/o char-level LSTM)w/s=15462018.10 | 72.1 | |
| Neural Transition-based Model (w/o pre-trained embeddings)w/s=14522018.10 | 72 | |
| Muis and Luw/s=2632018.10 | 70.8 | |
| Finkel and Manningw/s=382018.10 | 70.3 | |
| Lu and Rothw/s=4542018.10 | 70.3 | |
| DiZiNERZero-shot=true2026.04 | 60.1 | |
| DiZiNEREvaluation Protocol=Zero-shot2026.04 | 60.1 | |
| GLADEnsemble=true2026.04 | 58.9 | |
| MACEEnsemble=true2026.04 | 58.4 | |
| MVEnsemble=true2026.04 | 58 | |
| GPT-5 miniZero-shot=true2026.04 | 56.5 | |
| GPT-5 miniEvaluation Protocol=Zero-shot, Note=supervisor model2026.04 | 56.5 | |
| GLiNER-Lzero-shot=true2026.04 | 55.5 | |
| Prior Best ZSZero-shot=true2026.04 | 55.5 | |
| GLiNEREvaluation Protocol=Zero-shot2026.04 | 55.5 | |
| gliner_medium-v2.5Evaluation Protocol=Zero-shot2026.02 | 55.1 | |
| DSEnsemble=true2026.04 | 54.2 | |
| UniNER-7Bzero-shot=true2026.04 | 54.1 | |
| UniNER-7BEvaluation Protocol=Zero-shot2026.04 | 54.1 | |
| One-shotModel=Qwen-2.5-7b, Token Cost=3852026.06 | 52.91 | |
| BCLModel=Qwen-2.5-7b, Token Cost=5012026.06 | 51.36 | |
| One-shotModel=Llama-3.1-8b, Token Cost=3852026.06 | 51.29 | |
| JPT-4Bzero-shot=true2026.04 | 50.8 | |
| BCLModel=Pixtral-12B, Token Cost=5012026.06 | 50.65 | |
| BCLModel=Llama-3.1-8b, Token Cost=5012026.06 | 50.15 | |
| One-shotModel=Pixtral-12B, Token Cost=3852026.06 | 49.73 | |
| gliner_small-v2.5Evaluation Protocol=Zero-shot2026.02 | 48.5 | |
| GuideNERModel=Pixtral-12B, Token Cost=5062026.06 | 48.03 | |
| GuideNERModel=Qwen-2.5-7b, Token Cost=5062026.06 | 47.43 | |
| DEEPSTRUCTmode=zero-shot2022.05 | 47.2 | |
| DEEPSTRUCTEvaluation Protocol=zero-shot2022.05 | 47.2 | |
| BCLModel=Qwen-2.5-3b, Token Cost=5012026.06 | 46.98 | |
| gliner_large-v2.5Evaluation Protocol=Zero-shot2026.02 | 46.9 | |
| One-shotModel=Qwen-2.5-3b, Token Cost=3852026.06 | 46.78 | |
| GuideNERModel=Llama-3.1-8b, Token Cost=5062026.06 | 42.86 | |
| ChatGPTEvaluation Protocol=Zero-shot2026.04 | 41.6 | |
| GuideNERModel=Qwen-2.5-3b, Token Cost=5062026.06 | 41.49 | |
| ChatIEModel=Pixtral-12B, Token Cost=9422026.06 | 40.12 | |
| ChatIEModel=Llama-3.1-8b, Token Cost=9422026.06 | 35.2 | |
| ChatIEModel=Qwen-2.5-3b, Token Cost=9422026.06 | 33.32 | |
| CodeIEModel=Pixtral-12B, Token Cost=11722026.06 | 20.62 | |
| CodeIEModel=Qwen-2.5-7b, Token Cost=11722026.06 | 19.17 | |
| ChatIEModel=Qwen-2.5-7b, Token Cost=9422026.06 | 10.19 | |
| CodeIEModel=Qwen-2.5-3b, Token Cost=11722026.06 | 6.59 | |
| CodeIEModel=Llama-3.1-8b, Token Cost=11722026.06 | 0 |