Loading the SOTA2 catalog…
Divide and Conquer: Grounding LLMs as Efficient Decision-Making Agents via Offline Hierarchical Reinforcement Learning · SOTA2 Research