Named Entity Recognition on ACE05
89.1F1 ScoreGOLLIE
Evaluation Results
| Method | Links | |||
|---|---|---|---|---|
| GOLLIEevaluation=supervised2024.11 | 89.1 | — | — | |
| Hierarchical Multi-task ModelSetup=(I), Model=NER + EMD + RE2018.11 | 87.51 | 87.37 | 87.65 | |
| Hierarchical Multi-task ModelSetup=(J), Model=NER + EMD + CR2018.11 | 87.5 | 87.67 | 87.34 | |
| KnowCoder-Xevaluation=supervised2024.11 | 87.49 | — | — | |
| Hierarchical Multi-task ModelSetup=(A), Model=Full Model2018.11 | 87.36 | 87.52 | 87.21 | |
| BERTevaluation=supervised2024.11 | 87.3 | — | — | |
| Hierarchical Multi-task ModelSetup=(B), Model=NER2018.11 | 87.12 | 87.24 | 87 | |
| Strubell et al.Model=Strubell et al. 20172018.11 | 86.99 | — | — | |
| Hierarchical Multi-task ModelSetup=(F), Model=NER + EMD2018.11 | 86.91 | 87.5 | 86.32 | |
| BERT-MRCTraining Setting=standard2021.01 | 86.9 | — | — | |
| UniversalNERevaluation=supervised2024.11 | 86.69 | — | — | |
| Hierarchical Multi-task ModelSetup=(K), Model=EMD + NER2018.11 | 86.43 | 85.67 | 87.19 | |
| E2H-largeModel Category=Unified Models, Model Scale=large, Large-scale continued pre-training=false2023.05 | 86.25 | — | — | |
| Hierarchical Multi-task ModelSetup=(L), Model=EMD + NER + RE + CR2018.11 | 86.21 | 85.78 | 86.66 | |
| KnowCoderevaluation=supervised2024.11 | 86.1 | — | — | |
| LasUIE*Model Category=Unified Models, Large-scale continued pre-training=true2023.05 | 86 | — | — | |
| UIE*Model Category=Unified Models, Large-scale continued pre-training=true2023.05 | 85.78 | — | — | |
| T5-largeModel Category=Unified Models, Model Scale=large, Large-scale continued pre-training=false2023.05 | 85.76 | — | — | |
| DeBiasModel Category=Specialized Models, Large-scale continued pre-training=false2023.05 | 84.93 | — | — | |
| TANLTraining Setting=standard2021.01 | 84.9 | — | — | |
| TANLModel Category=Unified Models, Large-scale continued pre-training=false2023.05 | 84.9 | — | — | |
| E2H-baseModel Category=Unified Models, Model Scale=base, Large-scale continued pre-training=false2023.05 | 84.83 | — | — | |
| BARTNERModel Category=Specialized Models, Large-scale continued pre-training=false2023.05 | 84.74 | — | — | |
| TANLTraining Setting=multi-dataset2021.01 | 84.4 | — | — | |
| T5-baseModel Category=Unified Models, Model Scale=base, Large-scale continued pre-training=false2023.05 | 84.16 | — | — | |
| B2NERevaluation=supervised2024.11 | 83.04 | — | — | |
| GLINERevaluation=supervised2024.11 | 82.8 | — | — | |
| IEPILEevaluation=supervised2024.11 | 81.86 | — | — | |
| YAYI-UIEevaluation=supervised2024.11 | 81.78 | — | — | |
| InstructUIEevaluation=supervised2024.11 | 79.94 | — | — | |
| Neural Transition-based Modelw/s=14452018.10 | 73 | — | — | |
| Ju et al.2018.10 | 72.2 | — | — | |
| Neural Transition-based Model (w/o dropout layer)w/s=14402018.10 | 72 | — | — | |
| Neural Transition-based Model (w/o char-level LSTM)w/s=15462018.10 | 71.9 | — | — | |
| Neural Transition-based Model (w/o pre-trained embeddings)w/s=14522018.10 | 71.5 | — | — | |
| Katiyar and Cardie2018.10 | 70.5 | — | — | |
| Muis and Luw/s=2632018.10 | 63.1 | — | — | |
| Lu and Rothw/s=4542018.10 | 62.5 | — | — | |
| GPT-5 miniZero-shot=true2026.04 | 54 | — | — | |
| BCLSummary Model=Llama-3.1-8B, Inference Model=Llama-3.1-8B2026.06 | 53.1 | — | — | |
| BCLModel=Llama-3.1-8b, Token Cost=5012026.06 | 53.1 | — | — | |
| BCLSummary Model=Qwen-2.5-7B, Inference Model=GPT-3.5-turbo2026.06 | 53 | — | — | |
| BCLSummary Model=Llama-3.1-8B, Inference Model=GPT-3.5-turbo2026.06 | 52.5 | — | — | |
| Prior Best ZSZero-shot=true2026.04 | 51.2 | — | — | |
| GPT-3.5-turboSummary Model=-, Inference Model=GPT-3.5-turbo2026.06 | 51.03 | — | — | |
| BCLSummary Model=Qwen-2.5-7B, Inference Model=Qwen-2.5-7B2026.06 | 46.94 | — | — | |
| BCLModel=Qwen-2.5-7b, Token Cost=5012026.06 | 46.94 | — | — | |
| DiZiNERZero-shot=true2026.04 | 45 | — | — | |
| GuideNERModel=Llama-3.1-8b, Token Cost=5062026.06 | 44.97 | — | — | |
| JPT-4Bzero-shot=true2026.04 | 44.6 | — | — | |
| BCLModel=Pixtral-12B, Token Cost=5012026.06 | 42.87 | — | — | |
| GuideNERModel=Qwen-2.5-7b, Token Cost=5062026.06 | 41.57 | — | — | |
| One-shotModel=Llama-3.1-8b, Token Cost=3852026.06 | 40.98 | — | — | |
| One-shotModel=Pixtral-12B, Token Cost=3852026.06 | 39.15 | — | — | |
| GuideNERModel=Pixtral-12B, Token Cost=5062026.06 | 37.64 | — | — | |
| UniNER-7Bzero-shot=true2026.04 | 36.9 | — | — | |
| One-shotModel=Qwen-2.5-7b, Token Cost=3852026.06 | 35.73 | — | — | |
| BCLModel=Qwen-2.5-3b, Token Cost=5012026.06 | 35.46 | — | — | |
| ChatIEModel=Pixtral-12B, Token Cost=9422026.06 | 29.28 | — | — | |
| GuideNERModel=Qwen-2.5-3b, Token Cost=5062026.06 | 27.43 | — | — | |
| GLiNER-Lzero-shot=true2026.04 | 27.3 | — | — | |
| One-shotModel=Qwen-2.5-3b, Token Cost=3852026.06 | 27.08 | — | — | |
| ChatIEModel=Llama-3.1-8b, Token Cost=9422026.06 | 26.91 | — | — | |
| DSEnsemble=true2026.04 | 24.9 | — | — | |
| CodeIEModel=Qwen-2.5-3b, Token Cost=11722026.06 | 23.7 | — | — | |
| MACEEnsemble=true2026.04 | 23.5 | — | — | |
| CodeIEModel=Qwen-2.5-7b, Token Cost=11722026.06 | 22.76 | — | — | |
| GLADEnsemble=true2026.04 | 22.6 | — | — | |
| MVEnsemble=true2026.04 | 22.1 | — | — | |
| CodeIEModel=Pixtral-12B, Token Cost=11722026.06 | 18.57 | — | — | |
| ChatIEModel=Qwen-2.5-3b, Token Cost=9422026.06 | 15.41 | — | — | |
| ChatIEModel=Qwen-2.5-7b, Token Cost=9422026.06 | 11.83 | — | — | |
| CodeIEModel=Llama-3.1-8b, Token Cost=11722026.06 | 0.06 | — | — |