Machine Translation on WMT19 Zh-En (test)
27.25BLEUNMT + MSO
Evaluation Results
| Method | Links | |
|---|---|---|
| NMT + MSOobjective=Margin-based Sentence-level Objective2021.05 | 27.25 | |
| NMT + MTOobjective=Margin-based Token-level Objective2021.05 | 26.94 | |
| Transformer + CBMI-adaptiveModel Scale=big2022.03 | 26.3 | |
| Transformer + CBMI-adaptiveModel Scale=base2022.03 | 26.21 | |
| NMT + LMtraining_mode=joint training2021.05 | 25.9 | |
| Transformer + Self-Paced LearningModel Scale=big2022.03 | 25.88 | |
| Transformer + BMI-adaptiveModel Scale=big2022.03 | 25.81 | |
| Transformer + BMI-adaptiveModel Scale=base2022.03 | 25.77 | |
| NMT (Transformer)source=Re-implemented baseline, training steps=300K2021.05 | 25.75 | |
| Transformer + Self-Paced LearningModel Scale=base2022.03 | 25.75 | |
| Transformer + LM PriorModel Scale=base2022.03 | 25.71 | |
| Transformer + Freq-Chi-SquareModel Scale=big2022.03 | 25.64 | |
| Transformer + Anti-Focal LossModel Scale=big2022.03 | 25.64 | |
| Transformer + Freq-ExponentialModel Scale=big2022.03 | 25.57 | |
| Transformer + Focal LossModel Scale=big2022.03 | 25.54 | |
| Transformer + Anti-Focal LossModel Scale=base2022.03 | 25.5 | |
| TransformerModel Scale=big2022.03 | 25.48 | |
| Transformer + Freq-Chi-SquareModel Scale=base2022.03 | 25.43 | |
| Transformer + Focal LossModel Scale=base2022.03 | 25.37 | |
| TransformerModel Scale=base2022.03 | 25.36 | |
| Transformer + Freq-ExponentialModel Scale=base2022.03 | 24.99 | |
| Transformer + Simple FusionModel Scale=base2022.03 | 23.91 |