Loading the SOTA2 catalog…
Eliciting In-Context Learning in Vision-Language Models for Videos Through Curated Data Distributional Properties · SOTA2 Research