Conversational response generation on TopiOCQA
30.6F1 ScoreChatR1-7b
Evaluation Results
| Method | Links | ||
|---|---|---|---|
| ChatR1-7bRAG=RAG, LLM=Qwen-7b, Training Strategy=Supervised Fine-tuning or RL Training2025.10 | 30.6 | 79.5 | |
| UniConvRAG=RAG, LLM=Mistral 7b, Training Strategy=Supervised Fine-tuning or RL Training2025.10 | 29.6 | — | |
| ChatR1-3bRAG=RAG, LLM=Qwen-3b, Training Strategy=Supervised Fine-tuning or RL Training2025.10 | 29.4 | 80.9 | |
| ChatRetriever +Mis.RAG=RAG, LLM=Mistral 7b, Training Strategy=Supervised Fine-tuning or RL Training2025.10 | 28.3 | — | |
| Claude (DI)RAG=No, LLM=Claude, Training Strategy=Zero-Shot2025.10 | 27.2 | — | |
| conv-ANCE +Mis.RAG=RAG, LLM=Mistral 7b, Training Strategy=Supervised Fine-tuning or RL Training2025.10 | 27.2 | — | |
| ChatGPT (DI)RAG=No, LLM=GPT-3.5, Training Strategy=Zero-Shot2025.10 | 25.5 | 77.5 | |
| ChatR1 (w/o Rint.)RAG=RAG, LLM=Qwen-3b, Training Strategy=Supervised Fine-tuning or RL Training2025.10 | 24.4 | 73 | |
| QR Search R1RAG=RAG, LLM=Qwen-3b, Training Strategy=Supervised Fine-tuning or RL Training2025.10 | 20.1 | 72.7 | |
| SFTRAG=No, LLM=Qwen-3b, Training Strategy=Supervised Fine-tuning or RL Training2025.10 | 18 | 78.8 | |
| CoT R1RAG=No, LLM=Qwen-3b, Training Strategy=Supervised Fine-tuning or RL Training2025.10 | 12.5 | 70.3 | |
| IRCoTRAG=RAG, LLM=Qwen-3b, Training Strategy=Zero-Shot2025.10 | 8.9 | 61 | |
| Qwen-Instr. (RAG)RAG=RAG, LLM=Qwen-3b, Training Strategy=Zero-Shot2025.10 | 8.8 | 54.7 | |
| Qwen-Instr. (DI)RAG=No, LLM=Qwen-3b, Training Strategy=Zero-Shot2025.10 | 6.7 | 57.3 | |
| Qwen-Instr. (CoT)RAG=No, LLM=Qwen-3b, Training Strategy=Zero-Shot2025.10 | 6.7 | 58.6 |