Language Modeling on General Capability
0.685Capability ScoreIT+RL
Evaluation Results
| Method | Links | |
|---|---|---|
| IT+RLModel=Llama-3.1-8B, # Params=100%2025.12 | 0.685 | |
| OriginalModel=Llama-3.1-8B, # Params=-2025.12 | 0.674 | |
| DoRAModel=Llama-3.1-8B, # Params=0.22%2025.12 | 0.67 | |
| SAILSModel=Llama-3.1-8B, # Params=0.21%2025.12 | 0.67 | |
| LoRAModel=Llama-3.1-8B, # Params=0.21%2025.12 | 0.652 | |
| IT+RLModel=Gemma-2-9B, # Params=100%2025.12 | 0.57 | |
| PromptModel=Llama-3.1-8B, # Params=-2025.12 | 0.545 | |
| IT+RLModel=Gemma-2-2B, # Params=100%2025.12 | 0.495 | |
| OriginalModel=Gemma-2-2B, # Params=-2025.12 | 0.431 | |
| OriginalModel=Gemma-2-9B, # Params=-2025.12 | 0.411 | |
| SAILSModel=Gemma-2-9B, # Params=0.19%2025.12 | 0.404 | |
| PromptModel=Gemma-2-2B, # Params=-2025.12 | 0.392 | |
| PromptModel=Gemma-2-9B, # Params=-2025.12 | 0.39 | |
| SAILSModel=Gemma-2-2B, # Params=0.24%2025.12 | 0.366 | |
| DoRAModel=Gemma-2-2B, # Params=0.25%2025.12 | 0.365 | |
| LoRAModel=Gemma-2-2B, # Params=0.24%2025.12 | 0.362 | |
| LoRAModel=Gemma-2-9B, # Params=0.19%2025.12 | 0.35 | |
| DoRAModel=Gemma-2-9B, # Params=0.20%2025.12 | 0.34 | |
| FFTModel=Llama-3.1-8B, # Params=100%2025.12 | 0.339 | |
| FFTModel=Gemma-2-2B, # Params=100%2025.12 | 0.321 | |
| FFTModel=Gemma-2-9B, # Params=100%2025.12 | 0.313 |