Loading the SOTA2 catalog…
Vision-R1: Evolving Human-Free Alignment in Large Vision-Language Models via Vision-Guided Reinforcement Learning · SOTA2 Research