Machine Translation Ranking on GenMT MQM En→De 22
65.61AccuracyGemini-2.5-Pro
Evaluation Results
| Method | Links | |
|---|---|---|
| Gemini-2.5-ProParadigm=GQM, Reasoning Strategy=with Reasoning2026.02 | 65.61 | |
| DeepSeek-R1-0528Paradigm=GQM, Reasoning Strategy=with Reasoning2026.02 | 63.26 | |
| CometKiwi-XXLParadigm=SQM, Reasoning Strategy=without Reasoning2026.02 | 61.2 | |
| GRRM (RLVR)Paradigm=GQM, Reasoning Strategy=with Reasoning, Training Phase=RLVR2026.02 | 61.04 | |
| Gemini-2.5-ProParadigm=SQM, Reasoning Strategy=with Reasoning2026.02 | 58.92 | |
| GRRM (SFT)Paradigm=GQM, Reasoning Strategy=with Reasoning, Training Phase=SFT2026.02 | 58.65 | |
| BT-RMParadigm=SQM, Reasoning Strategy=without Reasoning2026.02 | 58.14 | |
| DeepSeek-R1-0528Paradigm=SQM, Reasoning Strategy=with Reasoning2026.02 | 53.64 | |
| SQM-GenRM (RLVR)Paradigm=SQM, Reasoning Strategy=with Reasoning, Training Phase=RLVR2026.02 | 49.16 | |
| SQM-GenRM (SFT)Paradigm=SQM, Reasoning Strategy=with Reasoning, Training Phase=SFT2026.02 | 48.37 | |
| RandomParadigm=N/A2026.02 | 35.91 |