Personality Measurement on The 16 Personalities (test)
80.7AccDimER_batch
Evaluation Results
| Method | Links | ||||||
|---|---|---|---|---|---|---|---|
| ER_batchMethod Class=INCHARACTER: Interview-based, Interviewer Model=GPT-42023.10 | 80.7 | 44.8 | 20.5 | — | — | 2.9 | |
| d-OCMethod Class=INCHARACTER: Interview-based, Interviewer Model=GPT-42023.10 | 80.2 | 45.8 | 21.2 | 3.3 | 21.3 | 2.1 | |
| ER_allMethod Class=INCHARACTER: Interview-based, Interviewer Model=GPT-42023.10 | 79.6 | 43.8 | 20.1 | — | — | 4.4 | |
| ER_allMethod Class=INCHARACTER: Interview-based, Interviewer Model=GPT-3.52023.10 | 79.1 | 45.8 | 22.1 | — | — | 5.9 | |
| ER_batchMethod Class=INCHARACTER: Interview-based, Interviewer Model=Qwen-110B2023.10 | 79.1 | 49 | 21.7 | — | — | 2.7 | |
| ER_batchMethod Class=INCHARACTER: Interview-based, Interviewer Model=GPT-3.52023.10 | 78.5 | 43.8 | 22.2 | — | — | 4.5 | |
| ER_allMethod Class=INCHARACTER: Interview-based, Interviewer Model=Qwen-110B2023.10 | 78 | 37.5 | 21 | — | — | 1.2 | |
| ER_batchMethod Class=INCHARACTER: Interview-based, Interviewer Model=Gemini2023.10 | 77.1 | 37.5 | 20.9 | — | — | 3.2 | |
| d-OCMethod Class=INCHARACTER: Interview-based, Interviewer Model=GPT-3.52023.10 | 76.9 | 40.6 | 21.8 | 6.4 | 22.7 | 4.6 | |
| ER_allMethod Class=INCHARACTER: Interview-based, Interviewer Model=Gemini2023.10 | 76.3 | 40.6 | 20.7 | — | — | 1.6 | |
| OCMethod Class=INCHARACTER: Interview-based, Interviewer Model=GPT-42023.10 | 75.5 | 34.4 | 23.1 | 4.9 | 28.1 | 2.4 | |
| d-OCMethod Class=INCHARACTER: Interview-based, Interviewer Model=Qwen-110B2023.10 | 74.9 | 40.6 | 23.2 | 3.3 | 21.4 | 2.2 | |
| d-OCMethod Class=INCHARACTER: Interview-based, Interviewer Model=Gemini2023.10 | 73.6 | 36.5 | 22.6 | 4.1 | 23.5 | 2.9 | |
| OCMethod Class=INCHARACTER: Interview-based, Interviewer Model=Qwen-110B2023.10 | 72.5 | 29.2 | 26.1 | 3.5 | 26.9 | 2 | |
| SR-CoTMethod Class=Self-report, Interviewer Model=GPT-3.52023.10 | 68 | 24 | 26.1 | 14.9 | 31.9 | 5.1 | |
| SR-CoTMethod Class=Self-report, Interviewer Model=GPT-42023.10 | 66.9 | 24 | 25.6 | 14.4 | 30.3 | 4.8 | |
| SR-CoTMethod Class=Self-report, Interviewer Model=Gemini2023.10 | 66.7 | 21.9 | 26.1 | 15.7 | 33.9 | 5.1 | |
| SRMethod Class=Self-report, Interviewer Model=GPT-3.52023.10 | 66.1 | 22.9 | 26.7 | 2.8 | 38.2 | 1.9 | |
| OCMethod Class=INCHARACTER: Interview-based, Interviewer Model=Gemini2023.10 | 66.1 | 25 | 27.3 | 6.1 | 30.4 | 2.6 | |
| SRMethod Class=Self-report, Interviewer Model=GPT-42023.10 | 65.6 | 21.9 | 26.5 | 3.3 | 37.7 | 2.1 | |
| SRMethod Class=Self-report, Interviewer Model=Gemini2023.10 | 65.3 | 21.9 | 26.8 | 5.5 | 46.1 | 2.1 | |
| OCMethod Class=INCHARACTER: Interview-based, Interviewer Model=GPT-3.52023.10 | 65 | 28.1 | 27.8 | 4.5 | 27.7 | 2 | |
| SRMethod Class=Self-report, Interviewer Model=Qwen-110B2023.10 | 62.3 | 22.9 | 27.2 | 2.9 | 38.3 | 1.8 | |
| SR-CoTMethod Class=Self-report, Interviewer Model=Qwen-110B2023.10 | 60.3 | 15.6 | 29.7 | 18.2 | 36.2 | 5.3 |