LLM-Generated Text Detection on AI vs Human (test)
95.143AUROCTelescope
Evaluation Results
| Method | Links | |
|---|---|---|
| TelescopeAggregation=Average AUROC across 12 reference models2026.07 | 95.143 | |
| PerplexityAggregation=Average AUROC across 12 reference models2026.07 | 90.743 | |
| DetectLLMAggregation=Average AUROC across 12 reference models2026.07 | 90.316 | |
| BinocularsAggregation=Average AUROC across 12 reference models2026.07 | 86.297 | |
| Fast-DetectGPTAggregation=Average AUROC across 12 reference models2026.07 | 75.608 |