8-Puzzle Solving on 8-Puzzle Solvable
43.6AccuracyGemini-3.0-Pro
Evaluation Results
| Method | Links | |
|---|---|---|
| Gemini-3.0-ProModel=Gemini-3.0-Pro2025.12 | 43.6 | |
| Deepseek-V3.2-RModel=Deepseek-V3.2-R2025.12 | 40.2 | |
| GPT-5.1-LowModel=GPT-5.1-Low2025.12 | 28.9 | |
| Qwen3-4B-Instruct + UnsolRL-FinalBase Model=Qwen3-4B-Instruct, Method=UnsolRL-Final2025.12 | 26.4 | |
| Qwen3-4B-InstructModel=Qwen3-4B-Instruct2025.12 | 21.6 | |
| Qwen3-1.7B-Instruct + UnsolRL-FinalBase Model=Qwen3-1.7B-Instruct, Method=UnsolRL-Final2025.12 | 1.2 | |
| Qwen3-1.7B-InstructModel=Qwen3-1.7B-Instruct2025.12 | 0.8 |