Visual Question Answering on CLEVR-Humans 1.0 (test)
85.5AccuracyIPRM
Evaluation Results
| Method | Links | |
|---|---|---|
| IPRMEvaluation Protocol=Fine-tuning2024.11 | 85.5 | |
| MDETREvaluation Protocol=Fine-tuning, Supervision=Object bounding-boxes2024.11 | 81.7 | |
| MACEvaluation Protocol=Fine-tuning2024.11 | 81.5 | |
| LEFTEvaluation Protocol=Fine-tuning2024.11 | 78.8 | |
| FiLMEvaluation Protocol=Fine-tuning2024.11 | 75.9 | |
| GLTEvaluation Protocol=Fine-tuning2024.11 | 75.8 | |
| RAMENEvaluation Protocol=Fine-tuning2024.11 | 67.8 | |
| IEPTraining Protocol=Train CLEVR, finetune human, Ground-truth programs=18K2017.05 | 66.6 | |
| PG+EEEvaluation Protocol=Fine-tuning, Supervision=Functional programs / pre-defined dataset-specific neural modules2024.11 | 66.6 | |
| IPRMEvaluation Protocol=Zero-shot2024.11 | 63.8 | |
| MDETREvaluation Protocol=Zero-shot, Supervision=Object bounding-boxes2024.11 | 59.9 | |
| NS-VQAEvaluation Protocol=Zero-shot, Supervision=Functional programs / pre-defined dataset-specific neural modules and object bounding-boxes2024.11 | 57.8 | |
| CNN+LSTM+SA+MLPTraining Protocol=Train CLEVR, finetune human2017.05 | 57.6 | |
| MACEvaluation Protocol=Zero-shot2024.11 | 57.4 | |
| FiLMEvaluation Protocol=Zero-shot2024.11 | 56.6 | |
| IEPTraining Protocol=Train CLEVR, Ground-truth programs=18K2017.05 | 54 | |
| PG+EEEvaluation Protocol=Zero-shot, Supervision=Functional programs / pre-defined dataset-specific neural modules2024.11 | 54 | |
| CNN+LSTM+SA+MLPTraining Protocol=Train CLEVR2017.05 | 50.4 | |
| CNN+LSTMTraining Protocol=Train CLEVR, finetune human2017.05 | 43.2 | |
| CNN+LSTMTraining Protocol=Train CLEVR2017.05 | 37.7 | |
| LSTMTraining Protocol=Train CLEVR, finetune human2017.05 | 36.5 | |
| LSTMTraining Protocol=Train CLEVR2017.05 | 27.5 |