NLU Intent Classification and Slot Filling on Chatbot Corpus (test)
97PrecisionLuis
Evaluation Results
| Method | Links | |||
|---|---|---|---|---|
| LuisBenchmark Run=August 20172018.05 | 97 | 91.8 | 94.3 | |
| RasaBenchmark Run=August 20172018.05 | 97 | 91.8 | 94.3 | |
| SnipsBenchmark Run=January 20182018.05 | 96.3 | 89.9 | 93 | |
| API.aiBenchmark Run=August 20172018.05 | 93.6 | 53.2 | 67.8 | |
| RasaBenchmark Run=January 20182018.05 | 93.3 | 92.1 | 92.7 | |
| IBM WatsonBenchmark Run=August 20172018.05 | 68.6 | 80 | 73.9 |