Language Modeling
8.005PerplexityOASIS
Evaluation Results
| Method | Links | |
|---|---|---|
| OASISModel=Llama-3.2-1B, Precision=FP162026.05 | 8.005 | |
| OASISModel=Llama-3.2-1B, Precision=W8A82026.05 | 8.162 | |
| VanillaModel=Llama-3.2-1B, Precision=FP162026.05 | 8.981 | |
| AoSModel=Llama-3.2-1B, Precision=FP162026.05 | 9 | |
| OutEffHopModel=Llama-3.2-1B, Precision=FP162026.05 | 9.07 | |
| OASISModel=Qwen3-0.6B, Precision=FP162026.05 | 9.202 | |
| AoSModel=Qwen3-0.6B, Precision=FP162026.05 | 9.345 | |
| AoSModel=Llama-3.2-1B, Precision=W8A82026.05 | 9.364 | |
| OASISModel=Qwen3-0.6B, Precision=W8A82026.05 | 9.517 | |
| AoSModel=Qwen3-0.6B, Precision=W8A82026.05 | 9.615 | |
| OutEffHopModel=Qwen3-0.6B, Precision=FP162026.05 | 9.991 | |
| OutEffHopModel=Llama-3.2-1B, Precision=W8A82026.05 | 10.419 | |
| VanillaModel=Qwen3-0.6B, Precision=FP162026.05 | 10.568 | |
| OutEffHopModel=Qwen3-0.6B, Precision=W8A82026.05 | 10.599 | |
| FP ModelBackbone=Qwen-1.7B, Weight Precision=1-bit, Activation Precision=8-bit2026.05 | 16.2 | |
| FP ModelBackbone=Qwen-0.6B, Weight Precision=1-bit, Activation Precision=8-bit2026.05 | 16.2 | |
| WINQBackbone=Qwen-1.7B, Weight Precision=2-bit, Activation Precision=8-bit2026.05 | 21.8 | |
| ParetoQBackbone=Qwen-1.7B, Weight Precision=2-bit, Activation Precision=8-bit2026.05 | 22.2 | |
| VanillaModel=Llama-3.2-1B, Precision=W8A82026.05 | 30.189 | |
| ParetoQBackbone=Qwen-0.6B, Weight Precision=2-bit, Activation Precision=8-bit2026.05 | 32 | |
| WINQBackbone=Qwen-0.6B, Weight Precision=2-bit, Activation Precision=8-bit2026.05 | 32 | |
| VanillaModel=Qwen3-0.6B, Precision=W8A82026.05 | 36.642 | |
| WINQBackbone=Qwen-1.7B, Weight Precision=1-bit, Activation Precision=8-bit2026.05 | 45.6 | |
| ParetoQBackbone=Qwen-1.7B, Weight Precision=1-bit, Activation Precision=8-bit2026.05 | 46.5 | |
| WINQBackbone=Qwen-0.6B, Weight Precision=1-bit, Activation Precision=8-bit2026.05 | 61.9 | |
| ParetoQBackbone=Qwen-0.6B, Weight Precision=1-bit, Activation Precision=8-bit2026.05 | 64 |