Reward Modeling on RM-Bench Normal
80AccuracyINF-ORM-Llama3.1-70B
Evaluation Results
| Method | Links | |
|---|---|---|
| INF-ORM-Llama3.1-70BBackbone=Llama3.1-70B2026.02 | 80 | |
| WILDREWARD-8BSize=8B2026.02 | 78.4 | |
| WILDREWARD-4BSize=4B2026.02 | 77 | |
| Athene-RM-8BSize=8B2026.02 | 76.6 | |
| Llama-3.1-Nemotron-70BSize=70B2026.02 | 76.5 | |
| Skywork-Reward-Llama-3.1-8B-v0.2Backbone=Llama-3.1-8B2026.02 | 74.2 | |
| Internlm2-20b-rewardSize=20b2026.02 | 74.2 | |
| Llama-3-OffsetBias-RM-8BSize=8B2026.02 | 73.2 | |
| Skywork-Reward-Gemma-2-27B-v0.2Backbone=Gemma-2-27B2026.02 | 71.9 | |
| ArmoRM-Llama3-8B-v0.1Backbone=Llama3-8B2026.02 | 71.5 |