Question Answering on QA Dataset 50 questions Long condition
72Accuracystm+sum+ltm
Evaluation Results
| Method | Links | |
|---|---|---|
| stm+sum+ltmModel=GPT-3.5, Tokens=5912026.03 | 72 | |
| oracleModel=GPT-4o-mini, Tokens=2992026.03 | 72 | |
| oracleModel=GPT-3.5, Tokens=2992026.03 | 70 | |
| stm+sum+ltmModel=GPT-4o-mini, Tokens=5912026.03 | 70 | |
| uniformModel=GPT-3.5, Tokens=7872026.03 | 68 | |
| uniformModel=GPT-4o-mini, Tokens=7872026.03 | 60 | |
| hybridModel=GPT-4o-mini, Tokens=3792026.03 | 52 | |
| hybridModel=GPT-3.5, Tokens=3792026.03 | 50 |