Language Modeling on Falcon
123.3PerplexitysHC
Evaluation Results
| Method | Links | |
|---|---|---|
| sHCModel Scale=L, Zero-shot evaluation=true, Training Dataset=FineWeb-Edu2026.03 | 123.3 | |
| mHC-liteModel Scale=L, Zero-shot evaluation=true, Training Dataset=FineWeb-Edu2026.03 | 124.9 | |
| mHCModel Scale=L, Zero-shot evaluation=true, Training Dataset=FineWeb-Edu2026.03 | 125.3 | |
| RCModel Scale=L, Zero-shot evaluation=true, Training Dataset=FineWeb-Edu2026.03 | 132.5 | |
| HCModel Scale=L, Zero-shot evaluation=true, Training Dataset=FineWeb-Edu2026.03 | 144.6 | |
| sHCModel Scale=M, Zero-shot evaluation=true, Training Dataset=FineWeb-Edu2026.03 | 165.4 | |
| mHC-liteModel Scale=M, Zero-shot evaluation=true, Training Dataset=FineWeb-Edu2026.03 | 168.5 | |
| mHCModel Scale=M, Zero-shot evaluation=true, Training Dataset=FineWeb-Edu2026.03 | 168.8 | |
| HCModel Scale=M, Zero-shot evaluation=true, Training Dataset=FineWeb-Edu2026.03 | 178.6 | |
| RCModel Scale=M, Zero-shot evaluation=true, Training Dataset=FineWeb-Edu2026.03 | 186.5 |