Loading the SOTA2 catalog…
Enhancing Visual-Language Modality Alignment in Large Vision Language Models via Self-Improvement · SOTA2 Research