Loading the SOTA2 catalog…
Bidirectional Cross-Modal Knowledge Exploration for Video Recognition with Pre-trained Vision-Language Models · SOTA2 Research