Video Quality Assessment on YouTube-UGC (test)
0.863SRCCFasterVQA
Evaluation Results
| Method | Links | ||
|---|---|---|---|
| FasterVQAResolution Range=360P - 2160P(4K), Efficiency=4X than FAST-VQA2022.10 | 0.863 | 0.859 | |
| FAST-VQAGroup=Ours, Protocol=Finetune2022.07 | 0.855 | 0.852 | |
| FAST-VQAResolution Range=360P - 2160P(4K)2022.10 | 0.855 | 0.852 | |
| Q-AlignTraining Dataset=LSVQ, Fine-tuning=False2025.05 | 0.833 | 0.846 | |
| BVQA-TCSVT-2022Group=Existing Fixed Deep, Resolution Range=360P - 2160P(4K)2022.10 | 0.831 | 0.819 | |
| MDS-VQALabeling Budget=5%2026.03 | 0.819 | 0.807 | |
| CoINVQGroup=Existing Fixed Deep, Resolution Range=360P - 2160P(4K)2022.10 | 0.816 | 0.802 | |
| FreeSelLabeling Budget=5%2026.03 | 0.814 | 0.798 | |
| CP-LLMTraining Dataset=LSVQ, Fine-tuning=False2025.05 | 0.81 | 0.813 | |
| CNN+VIDEVALGroup=Ensemble C+D, Protocol=Finetune2022.07 | 0.808 | 0.803 | |
| CNN+VIDEVALGroup=Ensemble C+D, Resolution Range=360P - 2160P(4K)2022.10 | 0.808 | 0.803 | |
| NoiseStabilityLabeling Budget=5%2026.03 | 0.806 | 0.798 | |
| Full-res Swin-T featuresGroup=Baseline Features, Protocol=Finetune2022.07 | 0.798 | 0.796 | |
| Full-res Swin-TResolution Range=360P - 2160P(4K), Features=Full-resolution Swin-T2022.10 | 0.798 | 0.796 | |
| Sampling by RDLabeling Budget=5%2026.03 | 0.795 | 0.784 | |
| FAST-VQA w/o VQ-representationsGroup=Ours, Protocol=Finetune2022.07 | 0.794 | 0.784 | |
| ModularBVQATraining Dataset=LSVQ, Fine-tuning=False2025.05 | 0.788 | 0.804 | |
| ALCSLabeling Budget=5%2026.03 | 0.785 | 0.772 | |
| Greedy samplingLabeling Budget=5%2026.03 | 0.781 | 0.773 | |
| VIDEVALGroup=Existing Classical, Resolution Range=360P - 2160P(4K)2022.10 | 0.779 | 0.773 | |
| DOVERTraining Dataset=LSVQ, Fine-tuning=False2025.05 | 0.777 | 0.792 | |
| Core-set selectionLabeling Budget=5%2026.03 | 0.776 | 0.765 | |
| VIDEVALGroup=Existing Classical, Protocol=Finetune2022.07 | 0.773 | 0.773 | |
| FAST-VQA-MGroup=Ours, Protocol=Finetune2022.07 | 0.768 | 0.765 | |
| FAST-VQA-MResolution Range=360P - 2160P(4K)2022.10 | 0.768 | 0.765 | |
| Random samplingLabeling Budget=5%2026.03 | 0.76 | 0.756 | |
| MC dropoutLabeling Budget=5%2026.03 | 0.76 | 0.753 | |
| RAPIQUEGroup=Existing Classical, Protocol=Finetune2022.07 | 0.759 | 0.768 | |
| RAPIQUEGroup=Existing Classical, Resolution Range=360P - 2160P(4K)2022.10 | 0.759 | 0.768 | |
| KSVQETrain Dataset=KVQ2024.02 | 0.742 | 0.764 | |
| VSFAGroup=Existing Fixed Deep, Protocol=Finetune2022.07 | 0.732 | 0.743 | |
| FastVQATraining Dataset=LSVQ, Fine-tuning=False2025.05 | 0.73 | 0.747 | |
| VSFAGroup=Existing Fixed Deep, Resolution Range=360P - 2160P(4K)2022.10 | 0.724 | 0.743 | |
| Base modelLabeling Budget=5%2026.03 | 0.708 | 0.709 | |
| SimpleVQATrain Dataset=KVQ2024.02 | 0.675 | 0.674 | |
| TLVQMGroup=Existing Classical, Protocol=Finetune2022.07 | 0.669 | 0.659 | |
| TLVQMGroup=Existing Classical, Resolution Range=360P - 2160P(4K)2022.10 | 0.669 | 0.659 | |
| FastVQATrain Dataset=KVQ2024.02 | 0.645 | 0.676 | |
| GST-VQAGroup=Existing Fixed Deep, Protocol=Finetune2022.07 | 0.61 | 0.592 | |
| VIDEVALTrain set=KoNViD-1k2020.05 | 0.37 | — | |
| ResNet-50Train set=LIVE-VQC2020.05 | 0.33 | — |