Visual Question Answering on VisualMRC (test)
264.1CIDErDocLLM-7B
Evaluation Results
| Method | Links | |
|---|---|---|
| DocLLM-7BModel Size=7B, Modality=Text+Layout, Evaluation Setting=SDDS2023.12 | 264.1 | |
| GPT-4+OCRModel Size=~1T, Modality=Text, Evaluation Setting=Zero-Shot (ZS)2023.12 | 255.1 | |
| DocLLM-1BModel Size=1B, Modality=Text+Layout, Evaluation Setting=SDDS2023.12 | 245 | |
| UReaderModel Size=~7B, Modality=Text+Vision, Evaluation Setting=SDDS2023.12 | 221.7 | |
| mPLUG-DocOwlModel Size=~7B, Modality=Text+Vision, Evaluation Setting=SDDS2023.12 | 188.8 | |
| Llama2+OCRModel Size=7B, Modality=Text, Evaluation Setting=Zero-Shot (ZS)2023.12 | 115.5 |