Conversational response generation on FaithDial
19.2F1 ScoreChatR1-3b
Evaluation Results
| Method | Links | ||
|---|---|---|---|
| ChatR1-3bRAG=RAG, LLM=Qwen-3b, Training Strategy=Supervised Fine-tuning or RL Training2025.10 | 19.2 | 84 | |
| SFTRAG=No, LLM=Qwen-3b, Training Strategy=Supervised Fine-tuning or RL Training2025.10 | 18.6 | 83.8 | |
| ChatR1-7bRAG=RAG, LLM=Qwen-7b, Training Strategy=Supervised Fine-tuning or RL Training2025.10 | 18.1 | 84.8 | |
| ChatR1 (w/o Rint.)RAG=RAG, LLM=Qwen-3b, Training Strategy=Supervised Fine-tuning or RL Training2025.10 | 15.5 | 81.3 | |
| CoT R1RAG=No, LLM=Qwen-3b, Training Strategy=Supervised Fine-tuning or RL Training2025.10 | 14.5 | 80.9 | |
| QR Search R1RAG=RAG, LLM=Qwen-3b, Training Strategy=Supervised Fine-tuning or RL Training2025.10 | 14.4 | 82.2 | |
| ChatGPT (DI)RAG=No, LLM=GPT-3.5, Training Strategy=Zero-Shot2025.10 | 12.9 | 80.9 | |
| Qwen-Instr. (RAG)RAG=RAG, LLM=Qwen-3b, Training Strategy=Zero-Shot2025.10 | 12.3 | 73.8 | |
| UniConvRAG=RAG, LLM=Mistral 7b, Training Strategy=Supervised Fine-tuning or RL Training2025.10 | 11.6 | — | |
| Qwen-Instr. (DI)RAG=No, LLM=Qwen-3b, Training Strategy=Zero-Shot2025.10 | 10.9 | 64.8 | |
| Qwen-Instr. (CoT)RAG=No, LLM=Qwen-3b, Training Strategy=Zero-Shot2025.10 | 9.6 | 64.8 | |
| IRCoTRAG=RAG, LLM=Qwen-3b, Training Strategy=Zero-Shot2025.10 | 9.6 | 64.7 |