Machine Translation on WMT En-Fi 17 (test)
30.1BLEU (tokenized)mRASP2
Evaluation Results
| Method | Links | |
|---|---|---|
| mRASP2Training Strategy=unified multilingual, Model Architecture (Layers)=12 layers2021.05 | 30.1 | |
| mRASPTraining Strategy=unified multilingual, Model Architecture (Layers)=12 layers, Fine-tuning Status=without fine-tune2021.05 | 29.2 | |
| mBARTTraining Strategy=pre-train & fine-tuned, Fine-tuning Status=fine-tuned2021.05 | 28.5 | |
| m-TransformerTraining Strategy=unified multilingual, Model Architecture (Layers)=12 layers2021.05 | 28.2 | |
| mRASPTraining Strategy=pre-train & fine-tuned, Fine-tuning Status=fine-tuned2021.05 | 28 | |
| mRASPTraining Strategy=pre-train & fine-tuned, Fine-tuning Status=fine-tuned2021.05 | 24 | |
| mRASP2Training Strategy=unified multilingual, Model Architecture (Layers)=12 layers2021.05 | 23.4 | |
| mBARTTraining Strategy=pre-train & fine-tuned, Fine-tuning Status=fine-tuned2021.05 | 22.4 | |
| Multi-DistillationTraining Strategy=unified multilingual2021.05 | 22 | |
| mRASPTraining Strategy=unified multilingual, Model Architecture (Layers)=12 layers, Fine-tuning Status=without fine-tune2021.05 | 22 | |
| Transformer-12Training Strategy=bilingual, Model Architecture (Layers)=12 layers2021.05 | 21.8 | |
| Multi-DistillationTraining Strategy=unified multilingual2021.05 | 21.2 | |
| Transformer-12Training Strategy=bilingual, Model Architecture (Layers)=12 layers2021.05 | 20.2 | |
| m-TransformerTraining Strategy=unified multilingual, Model Architecture (Layers)=12 layers2021.05 | 20 |