Aspect Sentiment Triplet Extraction on Rest 2016 (test)
74.83F1 ScoreMiniConGTS
Evaluation Results
| Method | Links | |||
|---|---|---|---|---|
| MiniConGTSParadigm=Table tagging2026.05 | 74.83 | 75.52 | 74.14 | |
| D2E2SParadigm=Span-based2026.05 | 74.74 | 77.97 | 71.77 | |
| Paraphrase + FiVeD-unifiedVerification Model=Qwen, Paradigm=Generative2026.05 | 74.7 | 73.66 | 75.8 | |
| Paraphrase + FiVeD-unifiedVerification Model=DeepSeek-Reasoner, Paradigm=Generative2026.05 | 74.47 | 74.17 | 74.79 | |
| Paraphrase + FiVeDVerification Model=DeepSeek-Reasoner, Paradigm=Generative2026.05 | 74.45 | 73.65 | 75.29 | |
| Paraphrase + FiVeDVerification Model=Qwen, Paradigm=Generative2026.05 | 74.43 | 74.2 | 74.67 | |
| MvP + FiVeD-unifiedVerification Model=DeepSeek-Reasoner, Paradigm=Generative2026.05 | 74.29 | 71.66 | 77.12 | |
| TAGSParadigm=Sequence tagging2026.05 | 74.17 | 75.4 | 72.48 | |
| MvP + FiVeD-unifiedVerification Model=Qwen, Paradigm=Generative2026.05 | 74.17 | 71.61 | 76.93 | |
| MvP + FiVeDVerification Model=Qwen, Paradigm=Generative2026.05 | 74.07 | 71.96 | 76.3 | |
| MvP + FiVeDVerification Model=DeepSeek-Reasoner, Paradigm=Generative2026.05 | 74.05 | 71.8 | 76.46 | |
| SimSTARParadigm=Table tagging2026.05 | 73.06 | 72.07 | 74.12 | |
| MvPParadigm=Generative2026.05 | 73.02 | 72.14 | 73.93 | |
| COM-MRCParadigm=MRC-based2026.05 | 71.57 | 71.55 | 71.59 | |
| GAS + FiVeDVerification Model=Qwen, Paradigm=Generative2026.05 | 70.28 | 68.4 | 72.34 | |
| Span-ASTEParadigm=Span-based2026.05 | 70.26 | 69.45 | 71.17 | |
| GAS + FiVeD-unifiedVerification Model=DeepSeek-Reasoner, Paradigm=Generative2026.05 | 70.25 | 65.17 | 76.26 | |
| GAS + FiVeDVerification Model=DeepSeek-Reasoner, Paradigm=Generative2026.05 | 70.13 | 67.42 | 73.27 | |
| GAS + FiVeD-unifiedVerification Model=Qwen, Paradigm=Generative2026.05 | 70.01 | 66.23 | 74.47 | |
| LEGOParadigm=Generative2026.05 | 69.9 | — | — | |
| ParaphraseParadigm=Generative2026.05 | 68.85 | 68.97 | 68.09 | |
| Triple-MRCParadigm=MRC-based2026.05 | 68.65 | — | — | |
| Span-BARTParadigm=Sequence tagging2026.05 | 67.62 | 66.6 | 68.68 | |
| Dual-MRCParadigm=MRC-based2026.05 | 67.4 | 68.6 | 66.24 | |
| GASParadigm=Generative2026.05 | 67.13 | 65.41 | 68.95 | |
| EMC-GCNParadigm=Table tagging2026.05 | 61.93 | 61.54 | 62.47 | |
| GPT-4oEvaluation Prompting Strategy=few-shot, Paradigm=Generative2026.05 | 60.63 | 52.9 | 71.01 | |
| GPT-3.5-turboEvaluation Prompting Strategy=few-shot, Paradigm=Generative2026.05 | 59.45 | 51.12 | 71.01 | |
| GPT-3.5-turboEvaluation Prompting Strategy=CoT + few-shot, Paradigm=Generative2026.05 | 54.86 | 46.49 | 66.93 | |
| Peng-two-stageParadigm=Sequence tagging2026.05 | 54.21 | 46.96 | 64.24 | |
| GPT-3.5-turboEvaluation Prompting Strategy=CoT, Paradigm=Generative2026.05 | 52.1 | 44.03 | 63.81 | |
| GPT-4oEvaluation Prompting Strategy=CoT + few-shot, Paradigm=Generative2026.05 | 49.45 | 41.53 | 61.09 | |
| GPT-3.5-turboEvaluation Prompting Strategy=zero-shot, Paradigm=Generative2026.05 | 47.22 | 39.92 | 57.78 | |
| GPT-4oEvaluation Prompting Strategy=CoT, Paradigm=Generative2026.05 | 46.79 | 39.14 | 58.17 | |
| GPT-4oEvaluation Prompting Strategy=zero-shot, Paradigm=Generative2026.05 | 36.8 | 32.17 | 43 |