Machine Translation on WMT En-Tr 17
25.8BLEUmRASP2
Evaluation Results
| Method | Links | |
|---|---|---|
| mRASP2Training Strategy=unified multilingual, Model Architecture (Layers)=12 layers2021.05 | 25.8 | |
| mRASPTraining Strategy=unified multilingual, Model Architecture (Layers)=12 layers, Fine-tuning Status=without fine-tune2021.05 | 25.2 | |
| CeMATPre-training=CeMAT, Fine-tuning=true, Beam Size=52022.03 | 23.9 | |
| CeMATPre-training=CeMAT, Fine-tuning=true, Beam Size=52022.03 | 23.6 | |
| mRASPTraining Strategy=pre-train & fine-tuned, Fine-tuning Status=fine-tuned2021.05 | 23.4 | |
| mRASPPre-training=mRASP, Fine-tuning=true, Beam Size=52022.03 | 23.4 | |
| m-TransformerTraining Strategy=unified multilingual, Model Architecture (Layers)=12 layers2021.05 | 23.1 | |
| mBARTTraining Strategy=pre-train & fine-tuned, Fine-tuning Status=fine-tuned2021.05 | 22.5 | |
| mBARTPre-training=mBART, Fine-tuning=true, Beam Size=52022.03 | 22.5 | |
| mRASP2020.10 | 20 | |
| mRASPPre-training=mRASP, Fine-tuning=true, Beam Size=52022.03 | 20 | |
| mBART2020.10 | 17.8 | |
| mBARTPre-training=mBART, Fine-tuning=true, Beam Size=52022.03 | 17.8 | |
| Transformer-12Training Strategy=bilingual, Model Architecture (Layers)=12 layers2021.05 | 12.2 | |
| DirectTraining=From scratch, Beam Size=52022.03 | 12.2 | |
| Direct2020.10 | 9.5 | |
| DirectTraining=From scratch, Beam Size=52022.03 | 9.5 |