Personality Measurement on The Big Five Inventory (test)
76.6Accuracy (Dimension)ER_all
Evaluation Results
| Method | Links | ||||||
|---|---|---|---|---|---|---|---|
| ER_allMethod Class=INCHARACTER: Interview-based, Interviewer Model=GPT-42023.10 | 76.6 | 30.2 | 18.9 | — | — | 4 | |
| ER_batchMethod Class=INCHARACTER: Interview-based, Interviewer Model=GPT-42023.10 | 76.6 | 31.2 | 18.2 | — | — | 3.6 | |
| ER_allMethod Class=INCHARACTER: Interview-based, Interviewer Model=Qwen-110B2023.10 | 74.3 | 28.1 | 19.3 | — | — | 4 | |
| ER_allMethod Class=INCHARACTER: Interview-based, Interviewer Model=GPT-3.52023.10 | 74.1 | 25 | 20.5 | — | — | 5.2 | |
| ER_batchMethod Class=INCHARACTER: Interview-based, Interviewer Model=Gemini2023.10 | 73.9 | 24 | 19.2 | — | — | 4.7 | |
| d-OCMethod Class=INCHARACTER: Interview-based, Interviewer Model=Qwen-110B2023.10 | 73.7 | 26 | 19.7 | 2.9 | 18.4 | 2.2 | |
| d-OCMethod Class=INCHARACTER: Interview-based, Interviewer Model=Gemini2023.10 | 72.8 | 18.8 | 20.4 | 4.2 | 20.8 | 3.3 | |
| ER_batchMethod Class=INCHARACTER: Interview-based, Interviewer Model=Qwen-110B2023.10 | 72.4 | 22.9 | 18.6 | — | — | 3.6 | |
| ER_batchMethod Class=INCHARACTER: Interview-based, Interviewer Model=GPT-3.52023.10 | 72.4 | 22.9 | 18.9 | — | — | 4.5 | |
| OCMethod Class=INCHARACTER: Interview-based, Interviewer Model=Gemini2023.10 | 72.2 | 14.6 | 21.3 | 6.8 | 27.6 | 5.1 | |
| d-OCMethod Class=INCHARACTER: Interview-based, Interviewer Model=GPT-42023.10 | 72.2 | 14.6 | 18.6 | 3.8 | 19.6 | 2.9 | |
| ER_allMethod Class=INCHARACTER: Interview-based, Interviewer Model=Gemini2023.10 | 71.5 | 18.8 | 20.6 | — | — | 4.9 | |
| OCMethod Class=INCHARACTER: Interview-based, Interviewer Model=Qwen-110B2023.10 | 68.2 | 9.4 | 20.8 | 3.8 | 22.5 | 2.4 | |
| SR-CoTMethod Class=Self-report, Interviewer Model=GPT-42023.10 | 67.1 | 9.4 | 22.3 | 12.5 | 25 | 5.1 | |
| SR-CoTMethod Class=Self-report, Interviewer Model=GPT-3.52023.10 | 66.9 | 9.4 | 22.6 | 12.9 | 25.2 | 5.5 | |
| SR-CoTMethod Class=Self-report, Interviewer Model=Gemini2023.10 | 66.2 | 8.3 | 22.6 | 13.2 | 26.1 | 5.3 | |
| OCMethod Class=INCHARACTER: Interview-based, Interviewer Model=GPT-3.52023.10 | 65.4 | 3.1 | 24.2 | 4.5 | 31.5 | 2.7 | |
| SR-CoTMethod Class=Self-report, Interviewer Model=Qwen-110B2023.10 | 65 | 10.4 | 22.8 | 13.4 | 26.5 | 5.5 | |
| OCMethod Class=INCHARACTER: Interview-based, Interviewer Model=GPT-42023.10 | 64.3 | 6.2 | 21.6 | 4.9 | 26.4 | 3.6 | |
| d-OCMethod Class=INCHARACTER: Interview-based, Interviewer Model=GPT-3.52023.10 | 64.1 | 5.2 | 22.9 | 5 | 18 | 3.8 | |
| SRMethod Class=Self-report, Interviewer Model=GPT-3.52023.10 | 63.7 | 7.3 | 23.4 | 2.3 | 30.2 | 1.5 | |
| SRMethod Class=Self-report, Interviewer Model=Qwen-110B2023.10 | 63.5 | 7.3 | 23.2 | 2.3 | 29.5 | 1.7 | |
| SRMethod Class=Self-report, Interviewer Model=Gemini2023.10 | 63.3 | 7.3 | 23.6 | 2 | 30.2 | 1.5 | |
| SRMethod Class=Self-report, Interviewer Model=GPT-42023.10 | 63.3 | 7.3 | 23.2 | 2.2 | 28.3 | 1.5 |