Multi-modal Document Understanding on OCRBench
270Recognition Score16bit
Evaluation Results
| Method | Links | ||||||
|---|---|---|---|---|---|---|---|
| 16bitModel=Qwen3-VL-8B, Precision=16-bit full-precision2026.05 | 270 | 181 | 174 | 181 | 52 | 858 | |
| OTTModel=Qwen3-VL-8B, Quantization=INT2, Group Size=1282026.05 | 270 | 179 | 170 | 177 | 54 | 850 | |
| OScaRModel=Qwen3-VL-8B, Quantization=INT2, Group Size=1282026.05 | 270 | 180 | 170 | 183 | 53 | 856 | |
| TurboQuant+Model=Qwen3-VL-8B, Quantization=2.5-bit2026.05 | 269 | 178 | 169 | 182 | 49 | 847 | |
| KIVIModel=Qwen3-VL-8B, Quantization=INT2, Group Size=1282026.05 | 268 | 178 | 173 | 180 | 52 | 851 | |
| RotateKVModel=Qwen3-VL-8B, Quantization=INT2, Group Size=1282026.05 | 267 | 163 | 127 | 162 | 35 | 754 | |
| QuaRotModel=Qwen3-VL-8B, Quantization=INT2, Group Size=1282026.05 | 266 | 171 | 104 | 150 | 31 | 722 | |
| 16bitModel=Qwen3-VL-4B, Precision=16-bit full-precision2026.05 | 261 | 183 | 171 | 186 | 51 | 852 | |
| TurboQuant+Model=Qwen3-VL-4B, Quantization=2.5-bit2026.05 | 260 | 183 | 170 | 175 | 40 | 828 | |
| OScaRModel=Qwen3-VL-4B, Quantization=INT2, Group Size=1282026.05 | 259 | 181 | 169 | 181 | 48 | 838 | |
| OTTModel=Qwen3-VL-4B, Quantization=INT2, Group Size=1282026.05 | 256 | 180 | 167 | 177 | 51 | 831 | |
| KIVIModel=Qwen3-VL-4B, Quantization=INT2, Group Size=1282026.05 | 255 | 177 | 160 | 175 | 46 | 813 | |
| QuaRotModel=Qwen3-VL-4B, Quantization=INT2, Group Size=1282026.05 | 254 | 173 | 149 | 159 | 38 | 773 | |
| RotateKVModel=Qwen3-VL-4B, Quantization=INT2, Group Size=1282026.05 | 254 | 143 | 84 | 134 | 23 | 638 | |
| 16bitModel=LLaVA-v1.6-vicuna-7B, Precision=16-bit full-precision2026.05 | 187 | 160 | 82 | 107 | 0 | 536 | |
| OTTModel=LLaVA-v1.6-vicuna-7B, Quantization=INT2, Group Size=1282026.05 | 187 | 157 | 72 | 97 | 0 | 513 | |
| OScaRModel=LLaVA-v1.6-vicuna-7B, Quantization=INT2, Group Size=1282026.05 | 178 | 158 | 82 | 101 | 0 | 519 | |
| QuaRotModel=LLaVA-v1.6-vicuna-7B, Quantization=INT2, Group Size=1282026.05 | 177 | 152 | 61 | 91 | 0 | 481 | |
| KIVIModel=LLaVA-v1.6-vicuna-7B, Quantization=INT2, Group Size=1282026.05 | 173 | 157 | 69 | 89 | 0 | 488 | |
| TurboQuant+Model=LLaVA-v1.6-vicuna-7B, Quantization=2.5-bit2026.05 | 173 | 156 | 73 | 99 | 0 | 501 | |
| RotateKVModel=LLaVA-v1.6-vicuna-7B, Quantization=INT2, Group Size=1282026.05 | 168 | 152 | 64 | 89 | 0 | 473 |