Advanced Mathematical Reasoning on OlympiadBench (accuracy)
12.8AccuracyTDA-RC
Evaluation Results
| Method | Links | |
|---|---|---|
| TDA-RCBase LLM=DeepSeek-V32026.03 | 12.8 | |
| TDA-RCBase LLM=GPT-4o-mini2026.03 | 12.6 | |
| TDA-RCBase LLM=Qwen-Turbo2026.03 | 12.3 | |
| Instruction InductionBase LLM=DeepSeek-V32026.03 | 12.2 | |
| HoTBase LLM=DeepSeek-V32026.03 | 12 | |
| Instruction InductionBase LLM=GPT-4o-mini2026.03 | 11.9 | |
| HoTBase LLM=GPT-4o-mini2026.03 | 11.7 | |
| Role / Persona PromptingBase LLM=DeepSeek-V32026.03 | 11.5 | |
| HoTBase LLM=Qwen-Turbo2026.03 | 11.4 | |
| Role / Persona PromptingBase LLM=GPT-4o-mini2026.03 | 11.3 | |
| Instruction InductionBase LLM=Qwen-Turbo2026.03 | 11.3 | |
| Prompt CanvasBase LLM=DeepSeek-V32026.03 | 11.1 | |
| Prompt CanvasBase LLM=GPT-4o-mini2026.03 | 11 | |
| Role / Persona PromptingBase LLM=Qwen-Turbo2026.03 | 10.7 | |
| Prompt CanvasBase LLM=Qwen-Turbo2026.03 | 10.4 | |
| Analogical PromptingBase LLM=DeepSeek-V32026.03 | 6.7 | |
| Analogical PromptingBase LLM=GPT-4o-mini2026.03 | 6.5 | |
| Analogical PromptingBase LLM=Qwen-Turbo2026.03 | 6.2 |