LLM-Generated Text Detection on GB Essay Deepseek V3 (test)
99.881AUROCPerplexity
Evaluation Results
| Method | Links | |
|---|---|---|
| PerplexityAggregation=Average AUROC across 12 reference models2026.07 | 99.881 | |
| DetectLLMAggregation=Average AUROC across 12 reference models2026.07 | 99.68 | |
| BinocularsAggregation=Average AUROC across 12 reference models2026.07 | 99.225 | |
| TelescopeAggregation=Average AUROC across 12 reference models2026.07 | 98.484 | |
| Fast-DetectGPTAggregation=Average AUROC across 12 reference models2026.07 | 82.763 |