Loading the SOTA2 catalog…
Hierarchical Pre-Training of Vision Encoders with Large Language Models · SOTA2 Research