General Reasoning on BBH (Cost and Token Consumption)
1Relative CostCoT
Evaluation Results
| Method | Links | ||
|---|---|---|---|
| CoTEvaluation Model=GPT-4o-mini2026.03 | 1 | 665 | |
| Analogical PromptingEvaluation Model=GPT-4o-mini2026.03 | 1.04 | — | |
| TDA-RCEvaluation Model=GPT-4o-mini2026.03 | 1.1 | — | |
| Role / Persona PromptingEvaluation Model=GPT-4o-mini2026.03 | 1.12 | — | |
| Prompt CanvasEvaluation Model=GPT-4o-mini2026.03 | 1.12 | — | |
| Instruction InductionEvaluation Model=GPT-4o-mini2026.03 | 1.15 | — | |
| HoTEvaluation Model=GPT-4o-mini2026.03 | 1.23 | — | |
| Self-RefineEvaluation Model=GPT-4o-mini2026.03 | 2.28 | — | |
| AoTEvaluation Model=GPT-4o-mini2026.03 | 3.33 | — | |
| AFlowEvaluation Model=GPT-4o-mini2026.03 | 4.16 | — | |
| CoT-SCEvaluation Model=GPT-4o-mini, n=52026.03 | 5.21 | — | |
| ToTEvaluation Model=GPT-4o-mini2026.03 | 5.61 | — | |
| GoTEvaluation Model=GPT-4o-mini2026.03 | 6.08 | — | |
| FoTEvaluation Model=GPT-4o-mini, n=82026.03 | 8.18 | — |