Loading the SOTA2 catalog…
Towards Open-Ended Emotional Support Conversations in LLMs via Reinforcement Learning with Future-Oriented Rewards · SOTA2 Research