Conversational response generation on INSCIT
33.2F1UniConv
Evaluation Results
| Method | Links | ||
|---|---|---|---|
| UniConvRAG=RAG, LLM=Mistral 7b, Training Strategy=Supervised Fine-tuning or RL Training2025.10 | 33.2 | — | |
| ChatR1-3bRAG=RAG, LLM=Qwen-3b, Training Strategy=Supervised Fine-tuning or RL Training2025.10 | 33.2 | 85.5 | |
| ChatR1-7bRAG=RAG, LLM=Qwen-7b, Training Strategy=Supervised Fine-tuning or RL Training2025.10 | 32.8 | 85.5 | |
| ChatR1 (w/o Rint.)RAG=RAG, LLM=Qwen-3b, Training Strategy=Supervised Fine-tuning or RL Training2025.10 | 31.3 | 84.4 | |
| ChatRetriever +Mis.RAG=RAG, LLM=Mistral 7b, Training Strategy=Supervised Fine-tuning or RL Training2025.10 | 30.3 | — | |
| QR Search R1RAG=RAG, LLM=Qwen-3b, Training Strategy=Supervised Fine-tuning or RL Training2025.10 | 27.5 | 84 | |
| Claude (DI)RAG=No, LLM=Claude, Training Strategy=Zero-Shot2025.10 | 27 | — | |
| conv-ANCE +Mis.RAG=RAG, LLM=Mistral 7b, Training Strategy=Supervised Fine-tuning or RL Training2025.10 | 24.8 | — | |
| CoT R1RAG=No, LLM=Qwen-3b, Training Strategy=Supervised Fine-tuning or RL Training2025.10 | 24.1 | 84 | |
| ChatGPT (DI)RAG=No, LLM=GPT-3.5, Training Strategy=Zero-Shot2025.10 | 22.8 | 81.1 | |
| IRCoTRAG=RAG, LLM=Qwen-3b, Training Strategy=Zero-Shot2025.10 | 20.4 | 67.3 | |
| Qwen-Instr. (DI)RAG=No, LLM=Qwen-3b, Training Strategy=Zero-Shot2025.10 | 17.9 | 58.1 | |
| SFTRAG=No, LLM=Qwen-3b, Training Strategy=Supervised Fine-tuning or RL Training2025.10 | 16.9 | 56.9 | |
| Qwen-Instr. (CoT)RAG=No, LLM=Qwen-3b, Training Strategy=Zero-Shot2025.10 | 16.4 | 62.4 | |
| Qwen-Instr. (RAG)RAG=RAG, LLM=Qwen-3b, Training Strategy=Zero-Shot2025.10 | 13 | 49.3 |