Question Answering on ARC Challenge (Accuracy improvement (Δ))
7.4Accuracy Improvement (Δ)Ultra-Dense Prompting
Evaluation Results
| Method | Links | |
|---|---|---|
| Ultra-Dense PromptingModel=Gemini 2.0, Prompt Strategy=Ultra-Dense (SDE > 0.80) vs Baseline, Reasoning Mode=Disabled2026.04 | 7.4 | |
| Ultra-Dense PromptingModel=Claude 3.7, Prompt Strategy=Ultra-Dense (SDE > 0.80) vs Baseline, Reasoning Mode=Disabled2026.04 | 6.8 | |
| Ultra-Dense PromptingModel=Average across Models, Prompt Strategy=Ultra-Dense (SDE > 0.80) vs Baseline, Reasoning Mode=Disabled2026.04 | 6.4 | |
| Ultra-Dense PromptingModel=GPT-4o, Prompt Strategy=Ultra-Dense (SDE > 0.80) vs Baseline, Reasoning Mode=Disabled2026.04 | 6.1 | |
| Ultra-Dense PromptingModel=GPT-4o-mini, Prompt Strategy=Ultra-Dense (SDE > 0.80) vs Baseline, Reasoning Mode=Disabled2026.04 | 5.5 |