Reading Comprehension on RC
76.5AccuracyYi
Evaluation Results
| Method | Links | ||
|---|---|---|---|
| YiSize=34B2024.03 | 76.5 | — | |
| QwenSize=14B2024.03 | 72.5 | — | |
| Llama2Size=70B2024.03 | 72.3 | — | |
| Llama2Size=34B2024.03 | 68.9 | — | |
| YiSize=6B2024.03 | 68.7 | — | |
| LAMIModel Scale=Large-Scale Instruct Models, Base=Qwen-2.5-7B-Inst.2024.06 | 64.4 | 66 | |
| Qwen-2.5-7B-InstructModel Scale=Large-Scale Instruct Models, Base=-2024.06 | 63 | 64.4 | |
| Baichuan-2Size=13B2024.03 | 62.4 | — | |
| SkyworkSize=13B2024.03 | 61.4 | — | |
| LAMIModel Scale=Large-Scale Instruct Models, Base=Llama3-8B-Inst.2024.06 | 60.9 | 62.7 | |
| Llama3-8B-InstructModel Scale=Large-Scale Instruct Models, Base=-2024.06 | 59.2 | 61.2 | |
| LAMIModel Scale=Large-Scale Models, Base=Llama3-8B2024.06 | 58 | 62 | |
| LAMIModel Scale=Large-Scale Models, Base=Vicuna-7B2024.06 | 57.9 | 55.1 | |
| Llama3-8BModel Scale=Large-Scale Models, Base=-2024.06 | 57.9 | 60.6 | |
| Qwen2-VL-7B-Instruct*Model Scale=Large-Scale Instruct Models, Base=Qwen-2.5-7B-Inst., VLM trained on large-scale image–text data=true2024.06 | 57.9 | 63.7 | |
| Vicuna-7BModel Scale=Large-Scale Models, Base=-2024.06 | 57.5 | 53.4 | |
| Llava-Next*Model Scale=Large-Scale Instruct Models, Base=Llama3-8B-Inst., VLM trained on large-scale image–text data=true2024.06 | 54.8 | 60.7 | |
| Llava-Next*Model Scale=Large-Scale Models, Base=Vicuna-7B, VLM trained on large-scale image–text data=true2024.06 | 54.7 | 53.1 | |
| InstructBLIP*Model Scale=Large-Scale Models, Base=Vicuna-7B, VLM trained on large-scale image–text data=true2024.06 | 53.6 | 52.1 | |
| LAMIModel Scale=Mid-Scale Models, Base=Gemma-2B2024.06 | 48.9 | 54.7 | |
| Gemma-2BModel Scale=Mid-Scale Models, Base=-2024.06 | 48.8 | 52.7 | |
| LAMIModel Scale=Small-Scale Models, Base=GPT-22024.06 | 32.2 | 39.2 | |
| GPT-2Model Scale=Small-Scale Models, Base=-2024.06 | 30.5 | 35.6 |