Logical Deduction Five Objects on Big-Bench Hard (test)
52.33AccuracyEvoPrompt(DE)-OPTS(TS)
Evaluation Results
| Method | Links | |
|---|---|---|
| EvoPrompt(DE)-OPTS(TS)Task-solving LLM=GPT-4o mini2025.03 | 52.33 | |
| EvoPrompt(GA)-OPTS(TS)Task-solving LLM=GPT-4o mini, Number of trials=32025.03 | 48.17 | |
| EvoPrompt(DE)Task-solving LLM=GPT-4o mini2025.03 | 2.67 | |
| EvoPrompt(GA)Task-solving LLM=GPT-4o mini, Number of trials=32025.03 | 1.67 |