Question Answering on QA Dataset 100 questions - Short condition
94Accuracyoracle
Evaluation Results
| Method | Links | |
|---|---|---|
| oracleModel=GPT-4o-mini, Tokens=2992026.03 | 94 | |
| oracleModel=GPT-3.5, Tokens=2992026.03 | 93 | |
| stm+sum+ltmModel=GPT-3.5, Tokens=5912026.03 | 92 | |
| stm+sum+ltmModel=GPT-4o-mini, Tokens=5912026.03 | 92 | |
| uniformModel=GPT-4o-mini, Tokens=7872026.03 | 92 | |
| uniformModel=GPT-3.5, Tokens=7872026.03 | 91 | |
| hybridModel=GPT-4o-mini, Tokens=3792026.03 | 80 | |
| hybridModel=GPT-3.5, Tokens=3792026.03 | 79 |