Machine-Generated Text Detection on XSum (Accuracy, F1)
91.7AccuracyDEER
Evaluation Results
| Method | Links | ||
|---|---|---|---|
| DEERMethod Category=Domain generalization methods, Evaluation Scenario=IND-MGT2025.11 | 91.7 | 91.67 | |
| RobertaMethod Category=Model-based methods, Evaluation Scenario=IND-MGT2025.11 | 88.77 | 89.61 | |
| ImBDMethod Category=Model-based methods, Evaluation Scenario=IND-MGT2025.11 | 88.77 | 88.85 | |
| MGT-PrismMethod Category=Domain generalization methods, Evaluation Scenario=IND-MGT2025.11 | 88.76 | 89.02 | |
| PeCoLAMethod Category=Model-based methods, Evaluation Scenario=IND-MGT2025.11 | 88.67 | 88.57 | |
| EAGLEMethod Category=Model-based methods, Evaluation Scenario=IND-MGT2025.11 | 88.08 | 89.25 | |
| MSCLMethod Category=Domain generalization methods, Evaluation Scenario=IND-MGT2025.11 | 87.5 | 88.12 | |
| MoSEsMethod Category=Model-based methods, Evaluation Scenario=IND-MGT2025.11 | 86.39 | 86.14 | |
| TACITMethod Category=Domain generalization methods, Evaluation Scenario=IND-MGT2025.11 | 85.23 | 85.76 | |
| GhostbusterMethod Category=Model-based methods, Evaluation Scenario=IND-MGT2025.11 | 82.44 | 81.84 | |
| BinocularsMethod Category=Metric-based methods, Evaluation Scenario=IND-MGT2025.11 | 71.77 | 66.77 | |
| Log-LikelihoodMethod Category=Metric-based methods, Evaluation Scenario=IND-MGT2025.11 | 65.22 | 54.38 | |
| LRRMethod Category=Metric-based methods, Evaluation Scenario=IND-MGT2025.11 | 64.84 | 53.11 | |
| RankMethod Category=Metric-based methods, Evaluation Scenario=IND-MGT2025.11 | 58.54 | 40.07 | |
| EntropyMethod Category=Metric-based methods, Evaluation Scenario=IND-MGT2025.11 | 51.23 | 50.76 | |
| Fast-DetectGPTMethod Category=Metric-based methods, Evaluation Scenario=IND-MGT2025.11 | 51.17 | 54.01 |