General Reasoning on Global MMLU 15 languages
54.77Macro AccuracyLlama 3.1
Evaluation Results
| Method | Links | |
|---|---|---|
| Llama 3.1Base Model=8B Instruct2026.05 | 54.77 | |
| Cross-Lingual ConsensusBase Model=Llama 3.1 8B Instruct2026.05 | 53.35 |
| Method | Links | |
|---|---|---|
| Llama 3.1Base Model=8B Instruct2026.05 | 54.77 | |
| Cross-Lingual ConsensusBase Model=Llama 3.1 8B Instruct2026.05 | 53.35 |