ResearchBenchmarksMulti-objective Offline Reinforcement Learning on Resource GatheringFollow4NDQDFM0.881.692.53.31Feb 5, 2026Evaluation ResultsMethodMethodLinksNDHV RatioSPQDFM2026.024——CQLScalarized=trueScalarized=true2026.021——