Automatic Speech Recognition on Low-resource Dialectal Speech 5 languages (test)
28.6WERCLD
Evaluation Results
| Method | Links | ||
|---|---|---|---|
| CLDASR Model Backbone=Whisper-Large-v3 (WSP-L)2026.05 | 28.6 | 15.37 | |
| NNASR Model Backbone=Whisper-Large-v3 (WSP-L)2026.05 | 29.25 | 15.99 | |
| CLDASR Model Backbone=Whisper-Small (WSP)2026.05 | 31.74 | 17.84 | |
| Kernel SVMASR Model Backbone=Whisper-Large-v3 (WSP-L)2026.05 | 37.91 | 22.05 | |
| Linear SVMASR Model Backbone=Whisper-Large-v3 (WSP-L)2026.05 | 39.36 | 23.68 | |
| DefaultASR Model Backbone=Whisper-Large-v3 (WSP-L)2026.05 | 40.41 | 21.8 | |
| KNNASR Model Backbone=Whisper-Large-v3 (WSP-L)2026.05 | 44.89 | 29.12 | |
| CLDASR Model Backbone=MMS-1B2026.05 | 45.27 | 21.58 | |
| Kernel SVMASR Model Backbone=Whisper-Small (WSP)2026.05 | 46.52 | 26.14 | |
| NNASR Model Backbone=MMS-1B2026.05 | 48.26 | 23.64 | |
| Linear SVMASR Model Backbone=Whisper-Small (WSP)2026.05 | 48.74 | 28.28 | |
| Kernel SVMASR Model Backbone=MMS-1B2026.05 | 49.12 | 25.88 | |
| Linear SVMASR Model Backbone=MMS-1B2026.05 | 50.73 | 26.07 | |
| DefaultASR Model Backbone=MMS-1B2026.05 | 51.88 | 27.61 | |
| NNASR Model Backbone=Whisper-Small (WSP)2026.05 | 53.84 | 34.52 | |
| KNNASR Model Backbone=MMS-1B2026.05 | 57.34 | 32.76 | |
| DefaultASR Model Backbone=Whisper-Small (WSP)2026.05 | 139.37 | 73.85 | |
| KNNASR Model Backbone=Whisper-Small (WSP)2026.05 | 145.21 | 81.05 |