Table Question Answering on STQA L
75.3AccuracyEnoTab
Evaluation Results
| Method | Links | |
|---|---|---|
| EnoTabEvaluation Model=GPT-4o2025.09 | 75.3 | |
| EnoTabEvaluation Model=GPT-4o-mini2025.09 | 72.5 | |
| TabLaPEvaluation Model=GPT-4o2025.09 | 69.1 | |
| Chain-of-ThoughtEvaluation Model=GPT-4o2025.09 | 66.7 | |
| End-to-End QAEvaluation Model=GPT-4o2025.09 | 66.4 | |
| H-StarEvaluation Model=GPT-4o2025.09 | 66.2 | |
| TabLaPEvaluation Model=GPT-4o-mini2025.09 | 65.9 | |
| H-StarEvaluation Model=GPT-4o-mini2025.09 | 63.8 | |
| TabSQLifyEvaluation Model=GPT-4o2025.09 | 60.6 | |
| Chain-of-ThoughtEvaluation Model=GPT-4o-mini2025.09 | 60.5 | |
| End-to-End QAEvaluation Model=GPT-4o-mini2025.09 | 59.8 | |
| TabSQLifyEvaluation Model=GPT-4o-mini2025.09 | 58.7 | |
| Chain-of-TableEvaluation Model=GPT-4o-mini2025.09 | 57.3 | |
| Chain-of-TableEvaluation Model=GPT-4o2025.09 | 57.1 | |
| DaterEvaluation Model=GPT-4o2025.09 | 50.4 | |
| BinderEvaluation Model=GPT-4o2025.09 | 48.7 | |
| Text-to-SQLEvaluation Model=GPT-4o-mini2025.09 | 47.1 | |
| Text-to-SQLEvaluation Model=GPT-4o2025.09 | 46.3 | |
| BinderEvaluation Model=GPT-4o-mini2025.09 | 45.6 | |
| DaterEvaluation Model=GPT-4o-mini2025.09 | 42.6 |