Moral Judgment on Moral Stories
100AccuracyGPT-4o
Evaluation Results
| Method | Links | |
|---|---|---|
| GPT-4oSamples per dataset=1002026.03 | 100 | |
| GPT-4o-miniSamples per dataset=1002026.03 | 100 | |
| GPT-5Samples per dataset=1002026.03 | 100 | |
| GPT-5-miniSamples per dataset=1002026.03 | 100 | |
| o3-miniSamples per dataset=1002026.03 | 100 | |
| o4-miniSamples per dataset=1002026.03 | 100 |