ResearchDatasetsInvDoublePendFollowBenchmarksTask NameDataset NameSOTA MethodSortMost resultsRecently updatedMost papersApplyTask NameDataset NameSOTA ResultTrendResultsReinforcement LearningInvDoublePend2,000,000Episodes Run3Meta-Reinforcement LearningInvDoublePend params39FLOPs (k)3Reinforcement LearningInvDoublePend standard (test)15Episode Length2Interpretability EvaluationInvDoublePend5Interpretability Score2