Tabular Classification on D130
43.7F1 ScoreTabM
Evaluation Results
| Method | Links | |
|---|---|---|
| TabM2026.06 | 43.7 | |
| CatBoost2026.06 | 42.8 | |
| XGBoost2026.06 | 42.7 | |
| TLRDBackbone=Gemma 3-12B, Teacher Model=Qwen3-Next-80B, Evaluation Protocol=Fine-tuned2026.06 | 38.1 | |
| GPT-OSS-120BEvaluation Protocol=Tri-level Reasoning2026.06 | 37.3 | |
| TLRDBackbone=Qwen3-8B, Teacher Model=Qwen3-Next-80B, Evaluation Protocol=Fine-tuned2026.06 | 36.9 | |
| Qwen3-8BEvaluation Protocol=Tri-level Reasoning2026.06 | 36.6 | |
| GPT-OSS-20BEvaluation Protocol=Tri-level Reasoning2026.06 | 36 | |
| TLRDBackbone=Llama 3.1-8B, Teacher Model=Qwen3-Next-80B, Evaluation Protocol=Fine-tuned2026.06 | 35.7 | |
| TLRDBackbone=Llama 3.1-8B, Teacher Model=GPT-OSS-120B, Evaluation Protocol=Fine-tuned2026.06 | 34.9 | |
| TLRDBackbone=Gemma 3-12B, Teacher Model=GPT-OSS-120B, Evaluation Protocol=Fine-tuned2026.06 | 34.5 | |
| TabPFN(v2.5)2026.06 | 34.3 | |
| TLRDBackbone=Qwen3-8B, Teacher Model=GPT-OSS-120B, Evaluation Protocol=Fine-tuned2026.06 | 33.4 | |
| TabPFN(v2.0)2026.06 | 33.3 | |
| Gemma 3-12BEvaluation Protocol=Tri-level Reasoning2026.06 | 33.2 | |
| Qwen3-Next-80BEvaluation Protocol=Tri-level Reasoning2026.06 | 30.4 | |
| Llama 3.1-8BEvaluation Protocol=Tri-level Reasoning2026.06 | 27.1 | |
| GPT-OSS-120BEvaluation Protocol=Zero-shot2026.06 | 21.1 | |
| Llama 3.1-8BEvaluation Protocol=Zero-shot2026.06 | 19.7 | |
| GPT-OSS-20BEvaluation Protocol=Zero-shot2026.06 | 14.2 | |
| Gemma 3-12BEvaluation Protocol=Zero-shot2026.06 | 9.2 | |
| Qwen3-Next-80BEvaluation Protocol=Zero-shot2026.06 | 8.9 | |
| Qwen3-8BEvaluation Protocol=Zero-shot2026.06 | 6.1 |