Reward Modeling on RM-Bench Easy
92.2AccuracyLlama-3.1-Nemotron-70B
Evaluation Results
| Method | Links | |
|---|---|---|
| Llama-3.1-Nemotron-70BSize=70B2026.02 | 92.2 | |
| INF-ORM-Llama3.1-70BBackbone=Llama3.1-70B2026.02 | 92.1 | |
| Athene-RM-8BSize=8B2026.02 | 89.8 | |
| Skywork-Reward-Gemma-2-27B-v0.2Backbone=Gemma-2-27B2026.02 | 88.9 | |
| Llama-3-OffsetBias-RM-8BSize=8B2026.02 | 83.9 | |
| WILDREWARD-8BSize=8B2026.02 | 83.5 | |
| WILDREWARD-4BSize=4B2026.02 | 82 | |
| ArmoRM-Llama3-8B-v0.1Backbone=Llama3-8B2026.02 | 80.4 | |
| Internlm2-20b-rewardSize=20b2026.02 | 79.4 | |
| Skywork-Reward-Llama-3.1-8B-v0.2Backbone=Llama-3.1-8B2026.02 | 70.5 |