Short-form Question Answering on SimpleQA (Accuracy)
21.7AccuracyCO-LMLM-360M-FW
Evaluation Results
| Method | Links | |
|---|---|---|
| CO-LMLM-360M-FWModel Size=360M, Training Corpus=FW2026.07 | 21.7 | |
| CO-LMLM-360MModel Size=360M2026.07 | 21.2 | |
| CO-LMLM-135MModel Size=135M2026.07 | 18.2 | |
| REL-LMLM-135MModel Size=135M2026.07 | 6.2 | |
| REL-LMLM-360MModel Size=360M2026.07 | 5.6 | |
| HF/SMOLLM2-1.7B*Model Size=1.7B, Training Token Count=11T2026.07 | 2.1 | |
| HF/SMOLLM2-360M*Model Size=360M, Training Token Count=4T2026.07 | 1.4 | |
| HF/SMOLLM2-135M*Model Size=135M, Training Token Count=2T2026.07 | 1.3 | |
| STANDARD-360M-FWModel Size=360M, Training Corpus=FW2026.07 | 1.3 | |
| STANDARD-360MModel Size=360M2026.07 | 0.3 | |
| STANDARD-135MModel Size=135M2026.07 | 0.1 |