Text Classification on SST-2 (Standard Accuracy)
94.8AccuracyICL
Evaluation Results
| Method | Links | |
|---|---|---|
| ICLBackbone=LLaMA-2-13B2026.05 | 94.8 | |
| ICLBackbone=Qwen-3-8B2026.05 | 94.48 | |
| ICLBackbone=Qwen-2.5-7B2026.05 | 94.4 | |
| ICLBackbone=LLaMA-3.1-8B2026.05 | 94.2 | |
| Task VectorBackbone=Qwen-2.5-7B2026.05 | 93.76 | |
| ICLBackbone=LLaMA-2-7B2026.05 | 93.52 | |
| ConMeZOBackbone=RoBERTa-Large, Training Steps=10K2025.11 | 93.5 | |
| I2CLBackbone=Qwen-3-8B2026.05 | 93.24 | |
| Task VectorBackbone=Qwen-3-8B2026.05 | 93.16 | |
| BERT-baseParams=110M, Attention=true, Tokenization=true2026.04 | 93 | |
| State VectorBackbone=Qwen-3-8B2026.05 | 92.24 | |
| Zero-shotBackbone=Qwen-3-8B2026.05 | 92.2 | |
| ByT5-SmallParams=300M, Attention=true, Tokenization=false2026.04 | 92 | |
| LTVBackbone=Qwen-2.5-7B2026.05 | 91.76 | |
| Function VectorBackbone=Qwen-3-8B2026.05 | 91.36 | |
| DistilBERTParams=66M, Attention=true, Tokenization=true2026.04 | 91 | |
| I2CLBackbone=LLaMA-3.1-8B2026.05 | 90.8 | |
| ConMeZOBackbone=OPT-1.3B, Training Steps=20K2025.11 | 90.6 | |
| LTVBackbone=Qwen-3-8B2026.05 | 90.4 | |
| LTVBackbone=LLaMA-2-7B2026.05 | 90.12 | |
| LTVBackbone=LLaMA-3.1-8B2026.05 | 90.08 | |
| ZO-AdaMMBackbone=RoBERTa-Large, Training Steps=20K2025.11 | 89.8 | |
| LTVBackbone=LLaMA-2-13B2026.05 | 88.96 | |
| Task VectorBackbone=LLaMA-3.1-8B2026.05 | 87.88 | |
| I2CLBackbone=Qwen-2.5-7B2026.05 | 87.36 | |
| Function VectorBackbone=LLaMA-3.1-8B2026.05 | 87.32 | |
| State VectorBackbone=LLaMA-2-13B2026.05 | 87.2 | |
| Zero-shotBackbone=LLaMA-3.1-8B2026.05 | 86.8 | |
| State VectorBackbone=Qwen-2.5-7B2026.05 | 86.64 | |
| CANINE-SParams=132M, Attention=true, Tokenization=false2026.04 | 85.8 | |
| ZO-AdaMMBackbone=OPT-1.3B, Training Steps=20K2025.11 | 84.4 | |
| State VectorBackbone=LLaMA-3.1-8B2026.05 | 84.12 | |
| USMoEBackbone=Transformer-XL(20M), Top-k=1.5, FLOPs=6.6753 x 10^10, Fine-tuning=true2025.03 | 83.8 | |
| KATHLEEN-CLEANParams=733K, Attention=false, Tokenization=false2026.04 | 83.3 | |
| Task VectorBackbone=LLaMA-2-13B2026.05 | 82.8 | |
| State VectorBackbone=LLaMA-2-7B2026.05 | 82.56 | |
| Task VectorBackbone=LLaMA-2-7B2026.05 | 81.6 | |
| USMoEBackbone=Transformer-XL(20M), Top-k=2, FLOPs=7.7620 x 10^10, Fine-tuning=true2025.03 | 81.5 | |
| ECBackbone=Transformer-XL(20M), Routing=Expert Choice (EC), Top-k=2, FLOPs=7.7620 x 10^10, Fine-tuning=true2025.03 | 81.5 | |
| Quaternion Attention (Tay et al., 2019)Latency (ms / batch)=3.92 ± 0.122026.05 | 81.12 | |
| shared-score quaternion self-attention mechanismLatency (ms / batch)=2.87 ± 0.072026.05 | 81.04 | |
| Zero-shotBackbone=LLaMA-2-7B2026.05 | 80.4 | |
| I2CLBackbone=LLaMA-2-7B2026.05 | 80.16 | |
| Kathleen FFT+PLGParams=149K, Attention=false, Tokenization=false2026.04 | 78.6 | |
| Function VectorBackbone=LLaMA-2-7B2026.05 | 78.6 | |
| SMoE-DRBackbone=Transformer-XL(20M), Routing=Token Choice (TC), Top-k=2, FLOPs=7.7620 x 10^10, Fine-tuning=true2025.03 | 78.6 | |
| StableMoEBackbone=Transformer-XL(20M), Routing=Token Choice (TC), Top-k=2, FLOPs=7.7620 x 10^10, Fine-tuning=true2025.03 | 77.7 | |
| SMoEBackbone=Transformer-XL(20M), Routing=Token Choice (TC), Top-k=2, FLOPs=7.7620 x 10^10, Fine-tuning=true2025.03 | 77.1 | |
| XMoEBackbone=Transformer-XL(20M), Routing=Token Choice (TC), Top-k=2, FLOPs=7.7620 x 10^10, Fine-tuning=true2025.03 | 76.7 | |
| Function VectorBackbone=LLaMA-2-13B2026.05 | 72.44 | |
| Zero-shotBackbone=LLaMA-2-13B2026.05 | 66.6 | |
| I2CLBackbone=LLaMA-2-13B2026.05 | 64.8 | |
| Function VectorBackbone=Qwen-2.5-7B2026.05 | 58.48 | |
| Zero-shotBackbone=Qwen-2.5-7B2026.05 | 54.8 |