ResearchBenchmarksOffline Reinforcement Learning on visual-cube single-play singletask task1 v0Follow89Normalized ScoreGTP80.6882.848587.16Oct 13, 2025Evaluation ResultsMethodMethodLinksNormalized ScoreGTPobservation_type=visua...observation_type=visual-observation, evaluation_seeds=4 random seeds2025.1089FQLobservation_type=visua...observation_type=visual-observation, evaluation_seeds=4 random seeds2025.1081