Structural QA on StructQA
78AccuracyTAMO
Evaluation Results
| Method | Links | |
|---|---|---|
| TAMOSetting=Frozen LLM, Backbone=Llama 3.1 8B2025.11 | 78 | |
| TAMO+Setting=Tuned LLM (SFT)2025.11 | 71.6 | |
| Prompt tuningSetting=Frozen LLM, Backbone=Llama 3.1 8B2025.11 | 71.53 | |
| TAMO+Setting=Tuned LLM (LoRA)2025.11 | 70.8 | |
| SFTSetting=Tuned LLM (SFT)2025.11 | 62.73 | |
| GPT-4.1Setting=Others2025.11 | 60.33 | |
| TAMOSetting=Frozen LLM2025.11 | 59.07 | |
| DeepSeek-R1Setting=Others2025.11 | 57.47 | |
| GPT-4Setting=Others2025.11 | 51.4 | |
| LoRASetting=Tuned LLM (LoRA)2025.11 | 45.67 | |
| GPT-3.5Setting=Others2025.11 | 41.93 | |
| Prompt tuningSetting=Frozen LLM2025.11 | 37.8 | |
| Llama 3.1 8BSetting=Inference Only2025.11 | 15.73 | |
| Zero-shotSetting=Inference Only2025.11 | 8.6 | |
| TableLlamaSetting=Tuned LLM (SFT)2025.11 | 6.47 |