LLM Preference Alignment Evaluation on Code-Pref
71Preference Score (spec vs ctl)Spec Learning
Evaluation Results
| Method | Links | |||
|---|---|---|---|---|
| Spec LearningProposer (P)=Kimi K2.6, Judge Model=GLM-5.12026.06 | 71 | 82 | 67 |
| Method | Links | |||
|---|---|---|---|---|
| Spec LearningProposer (P)=Kimi K2.6, Judge Model=GLM-5.12026.06 | 71 | 82 | 67 |