Loading the SOTA2 catalog…
SOTA2 Research · papers
Find papers, implementations, and the benchmark evidence behind state-of-the-art AI systems.
| Yaliang Li, Liuyi Yao, Nan Du |
| 2018 |
| arxiv 1810.05983 |
| Multi-Sourced Compositional Generalization in Visual Question Answering | Chuanhao Li, Wenbo Ye, Zhen Li | 2025 | arxiv 2505.23045 |
|---|
| Entity-Relation Extraction as Multi-Turn Question Answering | Xiaoya Li, Fan Yin, Zijun Sun | 2019 | arxiv 1905.05529 |
|---|
| Multi-Task Learning with Multi-View Attention for Answer Selection and Knowledge Base Question Answering | Yang Deng, Yuexiang Xie, Yaliang Li | 2018 | arxiv 1812.02354 |
|---|
| MoCA: Incorporating Multi-stage Domain Pretraining and Cross-guided Multimodal Attention for Textbook Question Answering | Fangzhi Xu, Qika Lin, Jun Liu | 2021 | arxiv 2112.02839 |
|---|
| GC-KBVQA: A New Four-Stage Framework for Enhancing Knowledge Based Visual Question Answering Performance | Mohammad Mahdi Moradi, Sudhir Mudur | 2025 | arxiv 2505.19354 |
|---|
| PerkwE_COQA: Enhanced Persian Conversational Question Answering by combining contextual keyword extraction with Large Language Models | Pardis Moradbeiki, Nasser Ghadiri | 2024 | arxiv 2404.05406 |
|---|
| Cooperative Retrieval-Augmented Generation for Question Answering: Mutual Information Exchange and Ranking by Contrasting Layers | Youmin Ko, Sungjong Seo, Hyunjoon Kim | 2025 | arxiv 2512.10422 |
|---|
| AVAM: Universal Training-free Adaptive Visual Anchoring Embedded into Multimodal Large Language Model for Multi-image Question Answering | Kang Zeng, Guojin Zhong, Jintao Cheng | 2025 | arxiv 2508.17860 |
|---|
| BEST-KAG: Enhancing Question Answering of Building Engineering Standards with Multimodal Knowledge Graph Modeling and Large Language Model | Jia-Rui Lin, Junxi Guo, Keyin Chen | 2026 | arxiv 2608.11244 |
|---|