Iterated Prisoner's Dilemma on IPD-Analytic (round robin)
-0.65Average Reward per EpisodeMFOS
Evaluation Results
| Method | Links | |
|---|---|---|
| MFOSOpponent=Naïve Learner2024.06 | -0.65 | |
| MFOSOpponent=M-MAML2024.06 | -0.81 | |
| MFOSOpponent=Reciprocator2024.06 | -0.98 | |
| MFOSOpponent=MFOS2024.06 | -1.01 | |
| LOLAOpponent=MFOS2024.06 | -1.02 | |
| MFOSOpponent=LOLA2024.06 | -1.02 | |
| ReciprocatorOpponent=Naïve Learner2024.06 | -1.03 | |
| LOLAOpponent=M-MAML2024.06 | -1.04 | |
| ReciprocatorOpponent=LOLA2024.06 | -1.05 | |
| ReciprocatorOpponent=M-MAML2024.06 | -1.05 | |
| ReciprocatorOpponent=Reciprocator2024.06 | -1.06 | |
| ReciprocatorOpponent=MFOS2024.06 | -1.06 | |
| Naïve LearnerOpponent=Reciprocator2024.06 | -1.06 | |
| LOLAOpponent=Reciprocator2024.06 | -1.08 | |
| LOLAOpponent=LOLA2024.06 | -1.09 | |
| M-MAMLOpponent=Reciprocator2024.06 | -1.13 | |
| M-MAMLOpponent=LOLA2024.06 | -1.15 | |
| M-MAMLOpponent=M-MAML2024.06 | -1.17 | |
| M-MAMLOpponent=Naïve Learner2024.06 | -1.25 | |
| Naïve LearnerOpponent=M-MAML2024.06 | -1.28 | |
| LOLAOpponent=Naïve Learner2024.06 | -1.3 | |
| Naïve LearnerOpponent=LOLA2024.06 | -1.52 | |
| M-MAMLOpponent=MFOS2024.06 | -1.56 | |
| Naïve LearnerOpponent=MFOS2024.06 | -1.88 | |
| Naïve LearnerOpponent=Naïve Learner2024.06 | -1.98 |