Multi-hop Question Answering on MuSiQue (pass@1)
32pass@1Qwen2.5-32B-Instruct + SSP
Evaluation Results
| Method | Links | |
|---|---|---|
| Qwen2.5-32B-Instruct + SSPTraining Paradigm=Scaling to Larger Models, SSP Integration=true2025.10 | 32 | |
| R-Search-7B + SSPTraining Paradigm=Continual Training on Search-Specialized Agents, SSP Integration=true2025.10 | 31.4 | |
| Search-R1-7B + SSPTraining Paradigm=Continual Training on Search-Specialized Agents, SSP Integration=true2025.10 | 30.6 | |
| R-Search-7BTraining Paradigm=Continual Training on Search-Specialized Agents, SSP Integration=false2025.10 | 29.8 | |
| Search-R1-7BTraining Paradigm=Continual Training on Search-Specialized Agents, SSP Integration=false2025.10 | 29.6 | |
| Qwen3-8B + SSPTraining Paradigm=Generalization Across Model Families, SSP Integration=true2025.10 | 28 | |
| Qwen2.5-14B-Instruct + SSPTraining Paradigm=Scaling to Larger Models, SSP Integration=true2025.10 | 28 | |
| Qwen2.5-32B-InstructTraining Paradigm=Scaling to Larger Models, SSP Integration=false2025.10 | 27.4 | |
| Qwen3-8BTraining Paradigm=Generalization Across Model Families, SSP Integration=false2025.10 | 26.6 | |
| Qwen2.5-14B-InstructTraining Paradigm=Scaling to Larger Models, SSP Integration=false2025.10 | 26.6 | |
| Qwen2.5-7B-Base + SSPTraining Paradigm=From-Scratch Training on Base and Instruct Models, SSP Integration=true2025.10 | 24 | |
| Qwen2.5-7B-Instruct + SSPTraining Paradigm=From-Scratch Training on Base and Instruct Models, SSP Integration=true2025.10 | 21.2 | |
| ZeroSearch-7B + SSPTraining Paradigm=Continual Training on Search-Specialized Agents, SSP Integration=true2025.10 | 19.6 | |
| ZeroSearch-7BTraining Paradigm=Continual Training on Search-Specialized Agents, SSP Integration=false2025.10 | 17.6 | |
| Qwen2.5-7B-InstructTraining Paradigm=From-Scratch Training on Base and Instruct Models, SSP Integration=false2025.10 | 16.8 | |
| LLaMA-3.1-8B + SSPTraining Paradigm=Generalization Across Model Families, SSP Integration=true2025.10 | 16.2 | |
| LLaMA-3.1-8BTraining Paradigm=Generalization Across Model Families, SSP Integration=false2025.10 | 11.4 | |
| Qwen2.5-7B-BaseTraining Paradigm=From-Scratch Training on Base and Instruct Models, SSP Integration=false2025.10 | 11 |