Commonsense Reasoning on LogiQA
29.8AccuracyDynamic Loss-Based
Evaluation Results
| Method | Links | |
|---|---|---|
| Dynamic Loss-BasedBackbone=GPT-2 Medium, Pre-training Dataset=SlimPajama2026.04 | 29.8 | |
| DoGraphBackbone=LLaMA-1.1B, Pre-training Dataset=The Pile2026.04 | 28.3 | |
| DoReMiBackbone=GPT-2 Medium, Pre-training Dataset=SlimPajama2026.04 | 27.2 | |
| DOGEBackbone=GPT-2 Medium, Pre-training Dataset=SlimPajama2026.04 | 27.2 | |
| DoReMiModel=GPT-2 Small, Training Data=SlimPajama2026.04 | 26.8 | |
| DoReMiBackbone=LLaMA-1.1B, Pre-training Dataset=The Pile2026.04 | 26.4 | |
| DoGraphBackbone=GPT-2 Medium, Pre-training Dataset=SlimPajama2026.04 | 26.3 | |
| Dynamic Loss-BasedModel=GPT-2 Small, Training Data=SlimPajama2026.04 | 26 | |
| DoGraphModel=GPT-2 Small, Training Data=SlimPajama2026.04 | 26 | |
| RegMixBackbone=LLaMA-1.1B, Pre-training Dataset=The Pile2026.04 | 25.8 | |
| UniformBackbone=GPT-2 Medium, Pre-training Dataset=SlimPajama2026.04 | 25.7 | |
| Data Mixing LawModel=GPT-2 Small, Training Data=SlimPajama2026.04 | 24.5 | |
| Data Mixing LawBackbone=GPT-2 Medium, Pre-training Dataset=SlimPajama2026.04 | 24.4 | |
| RegMixModel=GPT-2 Small, Training Data=SlimPajama2026.04 | 24.1 | |
| UniformBackbone=LLaMA-1.1B, Pre-training Dataset=The Pile2026.04 | 23.9 | |
| RegMixBackbone=GPT-2 Medium, Pre-training Dataset=SlimPajama2026.04 | 23.7 | |
| Data Mixing LawBackbone=LLaMA-1.1B, Pre-training Dataset=The Pile2026.04 | 23.6 | |
| DOGEModel=GPT-2 Small, Training Data=SlimPajama2026.04 | 23.5 | |
| DOGEBackbone=LLaMA-1.1B, Pre-training Dataset=The Pile2026.04 | 23.2 | |
| Dynamic Loss-BasedBackbone=LLaMA-1.1B, Pre-training Dataset=The Pile2026.04 | 22.8 | |
| UniformModel=GPT-2 Small, Training Data=SlimPajama2026.04 | 22.8 |