Commonsense Question Answering on Scientific Commonsense (QASC) 1.0 (dev)
55.18AccuracyGPT-3
Evaluation Results
| Method | Links | |
|---|---|---|
| GPT-3Answer predictor=T5-large2022.09 | 55.18 | |
| ELABORAnswer predictor=T5-large, Elaboration model=GPT2-large2022.09 | 54.21 | |
| pipelineAnswer predictor=T5-large, Elaboration model=GPT2-large2022.09 | 52.48 | |
| scratchAnswer predictor=T5-large, Elaboration model=GPT2-large2022.09 | 50.65 | |
| selftalkAnswer predictor=T5-large2022.09 | 50.22 | |
| COMETAnswer predictor=T5-large2022.09 | 49.35 | |
| vanillaAnswer predictor=T5-large2022.09 | 48.49 | |
| WikipediaAnswer predictor=T5-large2022.09 | 48.16 |