Predictive Reasoning Question Answering on Wearable Sensing Datasets (test)
83.9UARWEQA
Evaluation Results
| Method | Links | ||
|---|---|---|---|
| WEQATokens=10,4902026.06 | 83.9 | 10.9 | |
| ReActTokens=41,9022026.06 | 59.2 | 15.4 | |
| LLM-ImageGran.=daily, Tokens=4,6742026.06 | 56.7 | 15.1 | |
| LLM-ImageGran.=hourly, Tokens=3,9772026.06 | 56.2 | 15.1 | |
| LLM-TextGran.=hourly, Tokens=112,3282026.06 | 55.7 | 51.5 | |
| Multi-AgentTokens=32,3412026.06 | 55.2 | 24.9 | |
| LLM-TextGran.=daily, Tokens=72,2342026.06 | 54.5 | 51.5 | |
| Random2026.06 | 50 | 16.7 |