Function Optimization on Ackley
0.993Avg Max RewardmeanBEEBO
Evaluation Results
| Method | Links | |
|---|---|---|
| meanBEEBOd=2, sqrt(kappa)=0.1, Q=100, rounds=10, T'=1 / (2 * sqrt(kappa))2024.10 | 0.993 | |
| maxBEEBOd=2, sqrt(kappa)=0.1, Q=100, rounds=10, T'=1 / (2 * sqrt(kappa))2024.10 | 0.982 | |
| q-UCBd=2, sqrt(kappa)=0.1, Q=100, rounds=102024.10 | 0.973 | |
| meanBEEBOd=10, sqrt(kappa)=1, Q=100, rounds=10, T'=1 / (2 * sqrt(kappa))2024.10 | 0.908 | |
| meanBEEBOd=100, sqrt(kappa)=10, Q=100, rounds=10, T'=1 / (2 * sqrt(kappa))2024.10 | 0.863 | |
| q-UCBd=10, sqrt(kappa)=1, Q=100, rounds=102024.10 | 0.772 | |
| maxBEEBOd=10, sqrt(kappa)=1, Q=100, rounds=10, T'=1 / (2 * sqrt(kappa))2024.10 | 0.736 | |
| GI-PPO2023.12 | -0.0005 | |
| PPO2023.12 | -0.2489 | |
| RP2023.12 | -0.4821 | |
| LR+RP2023.12 | -1.2255 | |
| LR2023.12 | -1.2772 |