Long-context Evaluation on Ruler (Average rank)
2Average RankMinistral-3-8B
Evaluation Results
| Method | Links | |
|---|---|---|
| Ministral-3-8BParameters=8B2026.05 | 2 | |
| Qwen3-8BParameters=8B2026.05 | 2.3 | |
| Llama-3.1-8BParameters=8B2026.05 | 2.7 | |
| Qwen3-4BParameters=4B2026.05 | 4.3 | |
| gemma-3-12b-itParameters=12B, Instruction Tuned=true2026.05 | 5 | |
| GPT-5 nano2026.05 | 6 | |
| Llama-3.2-3BParameters=3B2026.05 | 6.7 | |
| gemma-3-4b-itParameters=4B, Instruction Tuned=true2026.05 | 9 | |
| gpt-oss-20bParameters=20B2026.05 | 9.3 | |
| Moonlight-16B-A3BParameters=16B2026.05 | 10.3 | |
| EngGPT2-16B-A3BParameters=16B2026.05 | 11.3 | |
| LLaMAntino-3-8BParameters=8B2026.05 | 11.3 | |
| FastwebMIIA-7BParameters=7B2026.05 | 12 | |
| Velvet-14BParameters=14B2026.05 | 13.7 | |
| deepseek-moe-16bParameters=16B2026.05 | 14.3 | |
| Minerva-7BParameters=7B2026.05 | 15.7 |