Word Similarity on MEN
0.596Spearman RhoOmni TM-AE
Evaluation Results
| Method | Links | |||
|---|---|---|---|---|
| Omni TM-AEHardware=CPU2026.05 | 0.596 | — | 0.439 | |
| FastOmniTMAEHardware=CPU2026.05 | 0.586 | — | 0.441 | |
| FastTextHardware=CPU2026.05 | 0.58 | — | 0.406 | |
| FastOmniTMAEHardware=CUDA2026.05 | 0.576 | — | 0.434 | |
| GloVeHardware=CPU2026.05 | 0.564 | — | 0.394 | |
| Word2VecHardware=CPU2026.05 | 0.561 | — | 0.391 | |
| ConceptsModel=Llama 3.1 8B, λ=1.02026.03 | 0.4362 | — | — | |
| ConceptsModel=Llama 3.1 8B, λ=1.02026.03 | 0.4275 | — | — | |
| ConceptsModel=Llama 3.1 8B, λ=0.752026.03 | 0.4193 | — | — | |
| ConceptsModel=Llama 3.1 8B, λ=0.752026.03 | 0.4154 | — | — | |
| ConceptsModel=Llama 3.1 8B, λ=0.52026.03 | 0.4086 | — | — | |
| ConceptsModel=Llama 3.1 8B, λ=0.52026.03 | 0.4073 | — | — | |
| ROOT-CAp=0, k (dimensionality)=500, Training Corpus (Text8, BNC, Wiki052024)=BNC2024.05 | 0.4 | — | — | |
| ConceptsModel=Llama 3.1 8B, λ=0.252026.03 | 0.3987 | — | — | |
| ConceptsModel=Llama 3.1 8B, λ=0.252026.03 | 0.3963 | — | — | |
| ConceptsModel=Llama 3.2 3B, λ=1.02026.03 | 0.3936 | — | — | |
| ConceptsModel=Llama 3.2 1B, λ=1.02026.03 | 0.3875 | — | — | |
| BaselineModel=Llama 3.1 8B, λ=0.02026.03 | 0.383 | — | — | |
| ConceptsModel=Llama 3.2 1B, λ=1.02026.03 | 0.3823 | — | — | |
| ConceptsModel=Llama 3.1 8B, λ=0.02026.03 | 0.3818 | — | — | |
| ConceptsModel=Llama 3.2 3B, λ=1.02026.03 | 0.3817 | — | — | |
| ROOT-CAp=0.5, k (dimensionality)=800, Training Corpus (Text8, BNC, Wiki052024)=BNC2024.05 | 0.374 | — | — | |
| ConceptsModel=Llama 3.2 1B, λ=0.752026.03 | 0.3679 | — | — | |
| ConceptsModel=Llama 3.2 1B, λ=0.752026.03 | 0.3659 | — | — | |
| ConceptsModel=Llama 3.2 3B, λ=0.752026.03 | 0.3649 | — | — | |
| ConceptsModel=Llama 3.2 3B, λ=0.752026.03 | 0.3605 | — | — | |
| BaselineModel=Llama 3.1 8B, λ=Base2026.03 | 0.3585 | — | — | |
| BaselineModel=Llama 3.1 8B, λ=Base2026.03 | 0.3585 | — | — | |
| ConceptsModel=Llama 3.2 1B, λ=0.52026.03 | 0.3527 | — | — | |
| ConceptsModel=Llama 3.2 1B, λ=0.52026.03 | 0.3519 | — | — | |
| ConceptsModel=Llama 3.2 3B, λ=0.52026.03 | 0.3507 | — | — | |
| ConceptsModel=Llama 3.2 3B, λ=0.52026.03 | 0.3483 | — | — | |
| NoiseModel=Llama 3.1 8B, λ=0.252026.03 | 0.3419 | — | — | |
| ConceptsModel=Llama 3.2 3B, λ=0.252026.03 | 0.3405 | — | — | |
| ROOTROOT-CAp=0, k (dimensionality)=600, Training Corpus (Text8, BNC, Wiki052024)=Text82024.05 | 0.34 | — | — | |
| ConceptsModel=Llama 3.2 3B, λ=0.252026.03 | 0.3372 | — | — | |
| ConceptsModel=Llama 3.2 1B, λ=0.252026.03 | 0.3366 | — | — | |
| ConceptsModel=Llama 3.2 1B, λ=0.252026.03 | 0.3365 | — | — | |
| NoiseModel=Llama 3.1 8B, λ=0.252026.03 | 0.3339 | — | — | |
| ConceptsModel=Llama 3.2 3B, λ=0.02026.03 | 0.327 | — | — | |
| ROOT-CAp=0, k (dimensionality)=800, Training Corpus (Text8, BNC, Wiki052024)=Text82024.05 | 0.325 | — | — | |
| ROOT-CAp=0.5, k (dimensionality)=9000, Training Corpus (Text8, BNC, Wiki052024)=Text82024.05 | 0.324 | — | — | |
| NoiseModel=Llama 3.1 8B, λ=0.52026.03 | 0.3225 | — | — | |
| BaselineModel=Llama 3.2 3B, λ=0.02026.03 | 0.3214 | — | — | |
| BaselineModel=Llama 3.2 1B, λ=Base2026.03 | 0.3196 | — | — | |
| BaselineModel=Llama 3.2 1B, λ=Base2026.03 | 0.3196 | — | — | |
| BaselineModel=Llama 3.2 1B, λ=0.02026.03 | 0.3182 | — | — | |
| BaselineModel=Llama 3.2 3B, λ=Base2026.03 | 0.3173 | — | — | |
| BaselineModel=Llama 3.2 3B, λ=Base2026.03 | 0.3173 | — | — | |
| ConceptsModel=Llama 3.2 1B, λ=0.02026.03 | 0.3162 | — | — | |
| NoiseModel=Llama 3.1 8B, λ=0.52026.03 | 0.3099 | — | — | |
| NoiseModel=Llama 3.2 1B, λ=0.252026.03 | 0.2969 | — | — | |
| NoiseModel=Llama 3.2 1B, λ=0.252026.03 | 0.2941 | — | — | |
| RAW-CAp=0, k (dimensionality)=600, Training Corpus (Text8, BNC, Wiki052024)=BNC2024.05 | 0.293 | — | — | |
| NoiseModel=Llama 3.2 3B, λ=0.252026.03 | 0.291 | — | — | |
| NoiseModel=Llama 3.2 3B, λ=0.252026.03 | 0.2908 | — | — | |
| NoiseModel=Llama 3.2 1B, λ=0.52026.03 | 0.2866 | — | — | |
| NoiseModel=Llama 3.1 8B, λ=0.752026.03 | 0.2846 | — | — | |
| NoiseModel=Llama 3.1 8B, λ=0.752026.03 | 0.2796 | — | — | |
| NoiseModel=Llama 3.2 3B, λ=0.52026.03 | 0.2771 | — | — | |
| NoiseModel=Llama 3.2 1B, λ=0.52026.03 | 0.2736 | — | — | |
| NoiseModel=Llama 3.2 3B, λ=0.52026.03 | 0.2663 | — | — | |
| NoiseModel=Llama 3.2 1B, λ=0.752026.03 | 0.2589 | — | — | |
| NoiseModel=Llama 3.2 3B, λ=0.752026.03 | 0.2489 | — | — | |
| NoiseModel=Llama 3.2 1B, λ=0.752026.03 | 0.2447 | — | — | |
| NoiseModel=Llama 3.2 3B, λ=0.752026.03 | 0.2366 | — | — | |
| RAW-CAp=0, k (dimensionality)=300, Training Corpus (Text8, BNC, Wiki052024)=Text82024.05 | 0.223 | — | — | |
| RAW-CAp=0, k (dimensionality)=1000, Training Corpus (Text8, BNC, Wiki052024)=Wiki0520242024.05 | 0.19 | — | — | |
| NoiseModel=Llama 3.1 8B, λ=1.02026.03 | 0.0909 | — | — | |
| NoiseModel=Llama 3.1 8B, λ=1.02026.03 | 0.0811 | — | — | |
| NoiseModel=Llama 3.2 1B, λ=1.02026.03 | 0.0753 | — | — | |
| NoiseModel=Llama 3.2 1B, λ=1.02026.03 | 0.0748 | — | — | |
| NoiseModel=Llama 3.2 3B, λ=1.02026.03 | 0.0634 | — | — | |
| NoiseModel=Llama 3.2 3B, λ=1.02026.03 | 0.0606 | — | — | |
| RAW-CAp=0, Training Corpus (Text8, BNC, Wiki052024)=Total2024.05 | — | 0.706 | — |