Conversational Response Generation on QReCC
31F1 ScoreChatR1-7b
Evaluation Results
| Method | Links | ||
|---|---|---|---|
| ChatR1-7bRAG=RAG, LLM=Qwen-7b, Training Strategy=Supervised Fine-tuning or RL Training2025.10 | 31 | 80.7 | |
| ChatR1-3bRAG=RAG, LLM=Qwen-3b, Training Strategy=Supervised Fine-tuning or RL Training2025.10 | 28 | 79.2 | |
| ChatR1 (w/o Rint.)RAG=RAG, LLM=Qwen-3b, Training Strategy=Supervised Fine-tuning or RL Training2025.10 | 27 | 78.5 | |
| ChatRetriever +Mis.RAG=RAG, LLM=Mistral 7b, Training Strategy=Supervised Fine-tuning or RL Training2025.10 | 26.3 | — | |
| UniConvRAG=RAG, LLM=Mistral 7b, Training Strategy=Supervised Fine-tuning or RL Training2025.10 | 26.2 | — | |
| conv-ANCE +Mis.RAG=RAG, LLM=Mistral 7b, Training Strategy=Supervised Fine-tuning or RL Training2025.10 | 25.9 | — | |
| Claude (DI)RAG=No, LLM=Claude, Training Strategy=Zero-Shot2025.10 | 25 | — | |
| SFTRAG=No, LLM=Qwen-3b, Training Strategy=Supervised Fine-tuning or RL Training2025.10 | 23.3 | 80 | |
| ChatGPT (DI)RAG=No, LLM=GPT-3.5, Training Strategy=Zero-Shot2025.10 | 22.6 | 75.6 | |
| QR Search R1RAG=RAG, LLM=Qwen-3b, Training Strategy=Supervised Fine-tuning or RL Training2025.10 | 20.4 | 79.6 | |
| CoT R1RAG=No, LLM=Qwen-3b, Training Strategy=Supervised Fine-tuning or RL Training2025.10 | 17.7 | 72.6 | |
| Qwen-Instr. (RAG)RAG=RAG, LLM=Qwen-3b, Training Strategy=Zero-Shot2025.10 | 15.5 | 64.5 | |
| Qwen-Instr. (DI)RAG=No, LLM=Qwen-3b, Training Strategy=Zero-Shot2025.10 | 13.3 | 55.3 | |
| IRCoTRAG=RAG, LLM=Qwen-3b, Training Strategy=Zero-Shot2025.10 | 13.1 | 55.6 | |
| Qwen-Instr. (CoT)RAG=No, LLM=Qwen-3b, Training Strategy=Zero-Shot2025.10 | 12.8 | 58.5 |