NL-to-Scala on WikiTQ
47.6Execution AccuracyTable-Specialist
Evaluation Results
| Method | Links | |
|---|---|---|
| Table-SpecialistBase Model=GPT-4, Training Strategy=Table-Specialist2024.10 | 47.6 | |
| Table-SpecialistBase Model=GPT-3.5, Training Strategy=Table-Specialist2024.10 | 42.6 | |
| GPT-4Base Model=GPT-4, Training Strategy=Vanilla2024.10 | 19.8 | |
| Table-SpecialistBase Model=Llama3.1-8B, Training Strategy=Table-Specialist2024.10 | 18.8 | |
| GPT-3.5Base Model=GPT-3.5, Training Strategy=Vanilla2024.10 | 10.9 | |
| Llama3.1-8BBase Model=Llama3.1-8B, Training Strategy=Vanilla2024.10 | 4.3 |