Evaluation on Overall Performance
85.18Average ScoreLD-MoLE
Evaluation Results
| Method | Links | |
|---|---|---|
| LD-MoLEModel=Llama3.1-8B, TP=2.33 %2025.09 | 85.18 | |
| ReMoLEModel=Llama3.1-8B, TP=2.17 %2025.09 | 84.47 | |
| MoLA(2468)Model=Llama3.1-8B, TP=1.26 %2025.09 | 82.85 | |
| MoLA(8888)Model=Llama3.1-8B, TP=2.17 %2025.09 | 82.48 | |
| LD-MoLEModel=Llama3.2-3B, TP=3.28 %2025.09 | 82.05 | |
| LD-MoLEModel=Qwen3-1.7B, TP=4.23 %2025.09 | 81.63 | |
| ReMoLEModel=Llama3.2-3B, TP=3.11 %2025.09 | 81.42 | |
| ReMoLEModel=Qwen3-1.7B, TP=4.12 %2025.09 | 81.02 | |
| MoLA(2468)Model=Qwen3-1.7B, TP=2.39 %2025.09 | 79.28 | |
| MoLA(8888)Model=Qwen3-1.7B, TP=4.12 %2025.09 | 79.24 | |
| MoLA(2468)Model=Llama3.2-3B, TP=1.80 %2025.09 | 78.72 | |
| MoLA(8888)Model=Llama3.2-3B, TP=3.11 %2025.09 | 78.18 | |
| UM-190kBase Model=OLMo-2-7B-SFT, DPO Training Dataset=UM-190k2025.11 | 50.02 | |
| UM-187kBase Model=OLMo-2-7B-SFT, DPO Training Dataset=UM-187k2025.11 | 49.8 | |
| UM-170kBase Model=OLMo-2-7B-SFT, DPO Training Dataset=UM-170k2025.11 | 49.14 | |
| TuluDPOBase Model=OLMo-2-7B-SFT, DPO Training Dataset=TuluDPO2025.11 | 48.27 | |
| ORPOBase Model=OLMo-2-7B-SFT, DPO Training Dataset=ORPO2025.11 | 47.26 | |
| UltraFBBase Model=OLMo-2-7B-SFT, DPO Training Dataset=UltraFB2025.11 | 47.08 | |
| Instella-3B-SFT (UM-190k)DPO Training Dataset=UM-190k2025.11 | 46.88 | |
| Instella-3B-SFT (UM-187k)DPO Training Dataset=UM-187k2025.11 | 46.58 | |
| CodePrefBase Model=OLMo-2-7B-SFT, DPO Training Dataset=CodePref2025.11 | 46.51 | |
| Instella-3B-SFT (UM-170k)DPO Training Dataset=UM-170k2025.11 | 45.95 | |
| HelpSteerBase Model=OLMo-2-7B-SFT, DPO Training Dataset=HelpSteer2025.11 | 45.78 | |
| Instella-3B-SFT (TuluDPO)DPO Training Dataset=TuluDPO2025.11 | 45.59 | |
| SFTBase Model=OLMo-2-7B-SFT, DPO Training Dataset=SFT2025.11 | 45.04 | |
| Instella-3B-SFT (ORPO)DPO Training Dataset=ORPO2025.11 | 44.88 | |
| Instella-3B-SFT (HelpSteer)DPO Training Dataset=HelpSteer2025.11 | 43.94 | |
| Instella-3B-SFT (CodePref)DPO Training Dataset=CodePref2025.11 | 43.72 | |
| Instella-3B-SFT (UltraFB)DPO Training Dataset=UltraFB2025.11 | 43.69 | |
| Instella-3B-SFT (SFT)DPO Training Dataset=None (SFT Baseline)2025.11 | 43.53 |