Texas Hold'em
0.3DQN ScoreAgent-Pro w/o Learning
Evaluation Results
| Method | Links | ||||
|---|---|---|---|---|---|
| Agent-Pro w/o LearningBased Model=Llama2-70B2024.02 | 0.3 | 3.3 | -1.2 | -1.8 | |
| ReflexionBased Model=GPT3.52024.02 | -0.1 | 2.5 | -0.9 | -1.5 | |
| Vanilla LLMBased Model=GPT3.52024.02 | -0.3 | 2.2 | -0.8 | -1.1 | |
| Aggressive LLMBased Model=GPT3.52024.02 | -0.4 | 3 | -0.5 | -2.1 | |
| Self-ConsistencyBased Model=GPT3.52024.02 | -0.5 | 1.9 | -0.8 | -0.6 | |
| Conservative LLMBased Model=Llama2-70B2024.02 | -0.5 | 3.4 | -0.8 | -2.1 | |
| Conservative LLMBased Model=GPT3.52024.02 | -0.7 | 2.9 | -0.9 | -1.3 | |
| ReActBased Model=GPT3.52024.02 | -0.7 | 1.7 | -0.7 | -0.3 | |
| Agent-Pro w/o LearningBased Model=GPT3.52024.02 | -0.7 | 1.8 | -1 | -0.1 | |
| Multi-AgentBased Model=Llama2-70B2024.02 | -0.7 | 3.5 | -1 | -1.8 | |
| Vanilla LLMBased Model=Llama2-70B2024.02 | -0.8 | 3.4 | -0.4 | -2.2 | |
| Self-ConsistencyBased Model=Llama2-70B2024.02 | -1 | 3.8 | -0.9 | -1.9 | |
| Multi-AgentBased Model=GPT3.52024.02 | -1.1 | 2.3 | -0.3 | -0.9 | |
| ReActBased Model=Llama2-70B2024.02 | -1.1 | 3.9 | -0.8 | -2 | |
| ReflexionBased Model=Llama2-70B2024.02 | -1.2 | 4.7 | -0.9 | -2.6 | |
| Agent-ProBased Model=Llama2-70B2024.02 | -1.2 | 3.1 | -0.5 | -1.4 | |
| Agent-ProBased Model=GPT3.52024.02 | -1.5 | 1.4 | -1.1 | 1.2 | |
| Conservative LLMBased Model=GPT42024.02 | -1.6 | 2.7 | -1.6 | 0.5 | |
| Aggressive LLMBased Model=Llama2-70B2024.02 | -1.6 | 7.6 | -1.2 | -4.8 | |
| Multi-AgentBased Model=GPT42024.02 | -1.8 | 1.9 | -1.2 | 1.1 | |
| Aggressive LLMBased Model=GPT42024.02 | -2 | 2.8 | -1 | 0.2 | |
| Vanilla LLMBased Model=GPT42024.02 | -2.2 | 1.7 | -0.9 | 1.4 | |
| ReActBased Model=GPT42024.02 | -2.4 | 1.3 | -1.1 | 2.2 | |
| ReflexionBased Model=GPT42024.02 | -2.6 | 2.1 | -0.7 | 1.2 | |
| Self-ConsistencyBased Model=GPT42024.02 | -2.8 | 2 | -0.7 | 1.5 | |
| Agent-Pro w/o LearningBased Model=GPT42024.02 | -3 | 1.5 | -1.2 | 2.7 | |
| Agent-ProBased Model=GPT42024.02 | -3.9 | 1.1 | -1.5 | 4.3 | |
| HumanBased Model=GPT3.52024.02 | -4 | 0.7 | -2.4 | 5.7 | |
| HumanBased Model=GPT42024.02 | -4 | 0.7 | -2.4 | 5.7 | |
| HumanBased Model=Llama2-70B2024.02 | -4 | 0.7 | -2.4 | 5.7 |