Value Alignment on Helpfulness 4
4.364Conformity ScoreQ+IF+COT
Evaluation Results
| Method | Links | |
|---|---|---|
| Q+IF+COTTarget Model=Gemini-1.5-Flash, Judge=GPT-4o2025.07 | 4.364 | |
| MODULARTarget Model=Gemini-1.5-Flash, Judge=GPT-4o2025.07 | 4.35 | |
| PICACOTarget Model=Gemini-1.5-Flash, Judge=GPT-4o2025.07 | 4.342 | |
| MP+SYSTEM 1Target Model=Gemini-1.5-Flash, Judge=GPT-4o2025.07 | 4.335 | |
| Q+IFTarget Model=Gemini-1.5-Flash, Judge=GPT-4o2025.07 | 4.332 | |
| OPROTarget Model=Gemini-1.5-Flash, Judge=GPT-4o2025.07 | 4.33 | |
| PICACO2025.07 | 4.287 | |
| URIALTarget Model=Gemini-1.5-Flash, Judge=GPT-4o2025.07 | 4.268 | |
| URIAL+SUMTarget Model=Gemini-1.5-Flash, Judge=GPT-4o2025.07 | 4.248 | |
| Q+IF2025.07 | 4.247 | |
| Q+IFModel=GPT-4o-mini2025.07 | 4.241 | |
| Q+IFTraining=SFT2025.07 | 4.21 | |
| MP+SYSTEM 2Target Model=Gemini-1.5-Flash, Judge=GPT-4o2025.07 | 4.163 | |
| QTarget Model=Gemini-1.5-Flash, Judge=GPT-4o2025.07 | 3.884 | |
| Q+IFTraining=SFT+2025.07 | 3.25 | |
| URIALTraining=SFT2025.07 | 2.443 |