Accuracy on MMLU (Multi-task Language Understanding)
83.29AccuracyQwen3.5-35B-A3B
Evaluation Results
| Method | Links | |
|---|---|---|
| Qwen3.5-35B-A3BPrecision=BF162026.06 | 83.29 | |
| BaseModel backbone=Qwen3-4B-It, Fine-tuning method=Base2026.05 | 77.6 | |
| BaseModel backbone=Qwen3-8B, Fine-tuning method=Base2026.05 | 73.1 | |
| BF162026.02 | 73 | |
| SVDQuantBit=W8A8, Format=INT2026.02 | 72.9 | |
| SVDQuantBit=W8A8, Format=MXFP2026.02 | 72.9 | |
| SmoothQuantBit=W8A8, Format=INT2026.02 | 72.8 | |
| SmoothQuantBit=W8A8, Format=MXFP2026.02 | 72.8 | |
| SVDQuantBit=W8A8, Format=HiF2026.02 | 72.8 | |
| RTNBit=W8A8, Format=INT2026.02 | 72.7 | |
| RTNBit=W8A8, Format=MXFP2026.02 | 72.7 | |
| RTNBit=W8A8, Format=HiF2026.02 | 72.3 | |
| SmoothQuantBit=W8A8, Format=HiF2026.02 | 72.3 | |
| Qwen3-8BPrecision=BF162026.06 | 72.01 | |
| SVDQuantBit=W4A4, Format=NVFP2026.02 | 71.9 | |
| SVDQuantBit=W4A4, Format=HiF2026.02 | 71.7 | |
| MIXSDModel backbone=Qwen3-8B, Fine-tuning method=MIXSD, Mixing rate λ=0.52026.05 | 71.5 | |
| SmoothQuantBit=W4A4, Format=NVFP2026.02 | 70.8 | |
| RTNBit=W4A4, Format=NVFP2026.02 | 70.6 | |
| RTNBit=W4A4, Format=HiF2026.02 | 70.5 | |
| SmoothQuantBit=W4A4, Format=HiF2026.02 | 70.5 | |
| GRPOModel=LLaMA-3.2-3B2025.05 | 69 | |
| MIXSDModel backbone=Qwen3-4B-It, Fine-tuning method=MIXSD, Mixing rate λ=02026.05 | 68.8 | |
| Llama-3.1-8B-InstPrecision=BF162026.06 | 68.77 | |
| SVDQuantBit=W4A4, Format=MXFP2026.02 | 68.5 | |
| MIXSDModel backbone=Qwen3-4B-It, Fine-tuning method=MIXSD, Mixing rate λ=0.72026.05 | 68.5 | |
| SFTModel backbone=Qwen3-4B-It, Fine-tuning method=SFT2026.05 | 68.1 | |
| TI-DPOModel=LLaMA-3.2-3B2025.05 | 68 | |
| MIXSDModel backbone=Qwen3-8B, Fine-tuning method=MIXSD, Mixing rate λ=0.32026.05 | 68 | |
| Phi-4-mini-InstPrecision=BF162026.06 | 67.9 | |
| MIXSDModel backbone=Qwen3-8B, Fine-tuning method=MIXSD, Mixing rate λ=02026.05 | 67.8 | |
| SFTModel backbone=Qwen3-8B, Fine-tuning method=SFT2026.05 | 67.4 | |
| SmoothQuantBit=W4A4, Format=MXFP2026.02 | 67 | |
| TPOModel=LLaMA-3.2-3B2025.05 | 67 | |
| CPOModel=LLaMA-3.2-3B2025.05 | 66 | |
| MIXSDModel backbone=Qwen3-8B, Fine-tuning method=MIXSD, Mixing rate λ=0.72026.05 | 65.5 | |
| Llama-3.1-8B (base)Precision=BF162026.06 | 65.39 | |
| Qwen2.5-3B-InstPrecision=BF162026.06 | 65.27 | |
| RTNBit=W4A4, Format=MXFP2026.02 | 65.2 | |
| KTOModel=LLaMA-3.2-3B2025.05 | 65 | |
| TDPOModel=LLaMA-3.2-3B2025.05 | 64.5 | |
| DPOModel=LLaMA-3.2-3B2025.05 | 64 | |
| SIMPOModel=LLaMA-3.2-3B2025.05 | 64 | |
| SFTModel=LLaMA-3.2-3B2025.05 | 63 | |
| Llama3 8B2026.02 | 62.2 | |
| IPOModel=LLaMA-3.2-3B2025.05 | 62 | |
| Mistral-7B-InstPrecision=BF162026.06 | 60.87 | |
| MIXSDModel backbone=Qwen3-4B-It, Fine-tuning method=MIXSD, Mixing rate λ=0.52026.05 | 59.9 | |
| SmoothQuantBit=W8A8, Format=INT2026.02 | 58.8 | |
| BaseModel backbone=Qwen3-1.7B, Fine-tuning method=Base2026.05 | 58.5 | |
| SmoothQuantBit=W8A8, Format=MXFP2026.02 | 58 | |
| SmoothQuantBit=W8A8, Format=HiF2026.02 | 57.8 | |
| BF16Format=BF162026.02 | 56.7 | |
| RTNBit=W4A4, Format=HiF2026.02 | 56.3 | |
| SVDQuantBit=W4A4, Format=HiF2026.02 | 55.9 | |
| SVDQuantBit=W8A8, Format=INT2026.02 | 55.7 | |
| SVDQuantBit=W8A8, Format=MXFP2026.02 | 55.1 | |
| RTNBit=W8A8, Format=INT2026.02 | 54.9 | |
| SVDQuantBit=W8A8, Format=HiF2026.02 | 54.3 | |
| SmoothQuantBit=W4A4, Format=HiF2026.02 | 54.3 | |
| OPSDModel backbone=Qwen3-4B-It, Fine-tuning method=OPSD2026.05 | 53.7 | |
| OPSDModel backbone=Qwen3-8B, Fine-tuning method=OPSD2026.05 | 53.6 | |
| RTNBit=W8A8, Format=MXFP2026.02 | 53.5 | |
| SVDQuantBit=W4A4, Format=NVFP2026.02 | 52.5 | |
| COMPOTCR=0.22026.02 | 52.4 | |
| SmoothQuantBit=W4A4, Format=MXFP2026.02 | 52.4 | |
| RTNBit=W8A8, Format=HiF2026.02 | 52.3 | |
| ReplaceMeCR=0.222026.02 | 51.7 | |
| SVDQuantBit=W4A4, Format=MXFP2026.02 | 51.3 | |
| MIXSDModel backbone=Qwen3-4B-It, Fine-tuning method=MIXSD, Mixing rate λ=0.32026.05 | 50.4 | |
| RTNBit=W4A4, Format=MXFP2026.02 | 49 | |
| RTNBit=W4A4, Format=NVFP2026.02 | 48.8 | |
| SmoothQuantBit=W4A4, Format=NVFP2026.02 | 48.6 | |
| Llama2 7BCR=None2025.09 | 40.9 | |
| Qwen3-0.6BCompression Ratio=None2026.02 | 40.2 | |
| COMPOTCR=0.32026.02 | 39.8 | |
| MIXSDModel backbone=Qwen3-1.7B, Fine-tuning method=MIXSD, Mixing rate λ=0.32026.05 | 39.5 | |
| SFTModel backbone=Qwen3-1.7B, Fine-tuning method=SFT2026.05 | 34.8 | |
| MIXSDModel backbone=Qwen3-1.7B, Fine-tuning method=MIXSD, Mixing rate λ=0.52026.05 | 34.7 | |
| SVDQuantBit=W4A4, Format=INT2026.02 | 32.5 | |
| ReplaceMeCR=0.312026.02 | 30.6 | |
| MIXSDModel backbone=Qwen3-1.7B, Fine-tuning method=MIXSD, Mixing rate λ=02026.05 | 30.4 | |
| COMPOTCR=0.42026.02 | 29.6 | |
| CoSpaDi (per-layer)CR=0.22025.09 | 28.2 | |
| SmoothQuantBit=W4A4, Format=INT2026.02 | 27.5 | |
| CoSpaDi (grouped)CR=0.22025.09 | 27.2 | |
| COMPOTCompression Ratio=0.32026.02 | 27.2 | |
| MIXSDModel backbone=Qwen3-1.7B, Fine-tuning method=MIXSD, Mixing rate λ=0.72026.05 | 27.1 | |
| CoSpaDi (per-layer)CR=0.32025.09 | 26.9 | |
| SVDQuantBit=W4A4, Format=INT2026.02 | 26.8 | |
| CoSpaDiCompression Ratio=0.22026.02 | 26.6 | |
| ReplaceMeCR=0.412026.02 | 26.4 | |
| COMPOT†Compression Ratio=0.22026.02 | 26.3 | |
| COMPOT†Compression Ratio=0.32026.02 | 26.3 | |
| MOE+Lngram2026.05 | 26.19 | |
| SVD-LLMCompression Ratio=0.22026.02 | 26.1 | |
| SVD-LLMCR=0.22025.09 | 25.5 | |
| MOE+Engram2026.05 | 25.02 | |
| LLM-PrunerCR=0.22026.02 | 25 | |
| COMPOTCompression Ratio=0.22026.02 | 24.9 |