Loading the SOTA2 catalog…
SOTA2 Research · papers
Find papers, implementations, and the benchmark evidence behind state-of-the-art AI systems.
| Title | Authors | Year | Source |
|---|---|---|---|
| Dual Refinement Feature Pyramid Networks for Object Detection | Jialiang Ma, Bin Chen | 2020 | arxiv 2012.01733 |
| SCD: A Stacked Carton Dataset for Detection and Segmentation | Jinrong Yang, Shengkai Wu, Lijun Gou | 2021 | arxiv 2102.12808 |
| VarifocalNet: An IoU-aware Dense Object Detector | Haoyang Zhang, Ying Wang, Feras Dayoub | 2020 | arxiv 2008.13367 |
| Quality-Aware Network for Human Parsing | Lu Yang, Qing Song, Zhihui Wang | 2021 | arxiv 2103.05997 |
| Neural Interactive Keypoint Detection | Jie Yang, Ailing Zeng, Feng Li | 2023 | arxiv 2308.10174 |
| Text-to-image Editing by Image Information Removal | Zhongping Zhang, Jian Zheng, Jacob Zhiyuan Fang | 2023 | arxiv 2305.17489 |
| Gen2Det: Generate to Detect | Saksham Suri, Fanyi Xiao, Animesh Sinha | 2023 | arxiv 2312.04566 |
| MobileInst: Video Instance Segmentation on the Mobile | Renhong Zhang, Tianheng Cheng, Shusheng Yang | 2023 | arxiv 2303.17594 |
| Faster R-CNN: Towards Real-Time Object Detection with Region Proposal Networks | Shaoqing Ren, Kaiming He, Ross Girshick | 2015 | arxiv 1506.01497 |
| MAT: A Multimodal Attentive Translator for Image Captioning | Chang Liu, Fuchun Sun, Changhu Wang | 2017 | arxiv 1702.05658 |
| Instances as Queries | Yuxin Fang, Shusheng Yang, Xinggang Wang | 2021 | arxiv 2105.01928 |
| LittleYOLO-SPP: A Delicate Real-Time Vehicle Detection Algorithm |
|---|
| Sri Jamiya S, Esther Rani P |
| 2020 |
| arxiv 2011.05940 |
| YOLO-IOD: Towards Real Time Incremental Object Detection | Shizhou Zhang, Xueqiang Lv, Yinghui Xing | 2025 | arxiv 2512.22973 |
|---|
| Evolutionary Caching to Accelerate Your Off-the-Shelf Diffusion Model | Anirud Aggarwal, Abhinav Shrivastava, Matthew Gwilliam | 2025 | arxiv 2506.15682 |
|---|
| DynaGuide: A Generalizable Dynamic Guidance Framework for Unsupervised Semantic Segmentation | Boujemaa Guermazi, Riadh Ksantini, Naimul Khan | 2026 | arxiv 2602.13020 |
|---|
| Do Generative Metrics Predict YOLO Performance? An Evaluation Across Models, Augmentation Ratios, and Dataset Complexity | Vasile Marian, Yong-Bin Kang, Alexander Buddery | 2026 | arxiv 2602.18525 |
|---|
| Guiding a Diffusion Model by Swapping Its Tokens | Weijia Zhang, Yuehao Liu, Shanyan Guan | 2026 | arxiv 2604.08048 |
|---|
| Beyond Known Objects: A Novel Framework for Open-Set Object Detection using Negative-Aware Norm | Yuchen Zhang, Yao Lu, Johannes Betz | 2026 | arxiv 2605.02284 |
|---|
| Evidence Recomposition and Predictive Context Residualization for Visual Attribution in Multimodal Large Language Models | Jiawei Liang, Jianjie Huang, Ruoyu Chen | 2025 | arxiv 2509.22415 |
|---|
| Support Operation Factorization: Compositional Readout of Frozen Vision Encoders under Controlled Interventions | Zhongyao Wang, Wanli Ouyang, Taoyong Cui | 2026 | arxiv 2608.06174 |
|---|