ResearchBenchmarksMulti-objective Offline Reinforcement Learning on Deep Sea TreasureFollow15NDQDFM0.444.22811.78Feb 5, 2026Evaluation ResultsMethodMethodLinksNDHV RatioSPQDFM2026.0215——CQLScalarized=trueScalarized=true2026.021——