Corpus Composition Inference on LLMScan Mid-Grained 1.0 (test)
65.98Overlap AccuracyLLMSurgeon
Evaluation Results
| Method | Links | |
|---|---|---|
| LLMSurgeonTarget Model=Pythia-12B2026.05 | 65.98 | |
| LLMSurgeonTarget Model=Pythia-2.8B2026.05 | 63.2 | |
| LLMSurgeonTarget Model=GPT-Neo-2.7B2026.05 | 61.86 | |
| GradNormTarget Model=GPT-Neo-2.7B2026.05 | 58.78 | |
| DC-PDDTarget Model=GPT-Neo-2.7B2026.05 | 56.07 | |
| GradNormTarget Model=Pythia-2.8B2026.05 | 55.66 | |
| DC-PDDTarget Model=Pythia-2.8B2026.05 | 55.43 | |
| RecallTarget Model=Pythia-2.8B2026.05 | 55.23 | |
| ZlibTarget Model=GPT-Neo-2.7B2026.05 | 55.16 | |
| Min-K%++Target Model=Pythia-2.8B2026.05 | 53.97 | |
| ZlibTarget Model=Pythia-2.8B2026.05 | 53.86 | |
| LossTarget Model=GPT-Neo-2.7B2026.05 | 53.54 | |
| Min-K%Target Model=GPT-Neo-2.7B2026.05 | 53.47 | |
| Min-K%++Target Model=GPT-Neo-2.7B2026.05 | 53.47 | |
| LossTarget Model=Pythia-2.8B2026.05 | 53.27 | |
| Min-K%Target Model=Pythia-2.8B2026.05 | 53.24 | |
| NeighborTarget Model=Pythia-12B2026.05 | 52.9 | |
| DUCITarget Model=GPT-Neo-2.7B2026.05 | 52.86 | |
| RecallTarget Model=Pythia-12B2026.05 | 52.63 | |
| DUCITarget Model=Pythia-2.8B2026.05 | 52.62 | |
| DUCITarget Model=Pythia-12B2026.05 | 52.62 | |
| DC-PDDTarget Model=Pythia-12B2026.05 | 52.53 | |
| LossTarget Model=Pythia-12B2026.05 | 52.36 | |
| RefTarget Model=GPT-Neo-2.7B2026.05 | 52.33 | |
| RefTarget Model=Pythia-2.8B2026.05 | 52.33 | |
| RefTarget Model=Pythia-12B2026.05 | 52.33 | |
| Joint-LogitTarget Model=Pythia-12B2026.05 | 52.26 | |
| Joint-LogitTarget Model=Pythia-2.8B2026.05 | 52.23 | |
| NeighborTarget Model=Pythia-2.8B2026.05 | 52.21 | |
| Joint-LogitTarget Model=GPT-Neo-2.7B2026.05 | 52.19 | |
| NeighborTarget Model=GPT-Neo-2.7B2026.05 | 51.85 | |
| Min-K%Target Model=Pythia-12B2026.05 | 50.23 | |
| RecallTarget Model=GPT-Neo-2.7B2026.05 | 49.04 | |
| ZlibTarget Model=Pythia-12B2026.05 | 47.8 | |
| GradNormTarget Model=Pythia-12B2026.05 | 35.98 | |
| Min-K%++Target Model=Pythia-12B2026.05 | 33.09 |