Offline Reinforcement Learning on HRI Board-game Emotion Offline Dataset
0.23Error RateCQL
Evaluation Results
| Method | Links | |
|---|---|---|
| CQLLearning Rate=0.01, Batch Size=16, Hidden Layer=1, Hidden Unit=32, Activation=ReLU2025.09 | 0.23 | |
| BCQLearning Rate=0.001, Batch Size=8, Hidden Layer=2, Hidden Unit=8, Activation=ReLU2025.09 | 1.44 | |
| DDQNLearning Rate=0.001, Batch Size=8, Hidden Layer=2, Hidden Unit=8, Activation=ReLU2025.09 | 1.5 | |
| DQNLearning Rate=0.01, Batch Size=16, Hidden Layer=1, Hidden Unit=16, Activation=ReLU2025.09 | 1.81 | |
| SACLearning Rate=0.01, Batch Size=16, Hidden Layer=2, Hidden Unit=16, Activation=ReLU2025.09 | 2.8 | |
| NFQLearning Rate=0.001, Batch Size=8, Hidden Layer=2, Hidden Unit=32, Activation=ReLU2025.09 | 5.06 |