Scene Text Recognition on COCO
80.4AccuracyViSu
Evaluation Results
| Method | Links | |
|---|---|---|
| ViSuDatasets=RL+RU2024.11 | 80.4 | |
| CLIP-OCR†Datasets=RL2024.11 | 78.3 | |
| ParSeq†Datasets=RL2024.11 | 77.8 | |
| TRBA-cr†Datasets=RL+RU2024.11 | 77.6 | |
| LPV†Datasets=RL2024.11 | 76.8 | |
| Baseline-ViSuTraining Datasets=SL+RU2024.11 | 74.9 | |
| MGP†Datasets=RL2024.11 | 74.1 | |
| LISTER†Datasets=RL2024.11 | 72.7 | |
| TRBA-cr*Training Datasets=SL+RU22024.11 | 70.3 | |
| TRBA-ViSuTraining Datasets=SL+RU2024.11 | 69.8 | |
| TRBA-cr†Training Datasets=SL+RU2024.11 | 69.3 | |
| BaselineTraining Datasets=SL2024.11 | 67.6 | |
| TRBA-pr*Datasets=RL1+RU12024.11 | 67.1 | |
| TRBA-pr*Training Datasets=RL+RU12024.11 | 67.1 | |
| CLIP-OCRTraining Datasets=SL2024.11 | 66.5 | |
| LISTER*Training Datasets=SL2024.11 | 65.8 | |
| MGP*Training Datasets=SL2024.11 | 65.4 | |
| ParSeqTraining Datasets=SL2024.11 | 64 | |
| TRBA†Training Datasets=SL2024.11 | 63.3 | |
| ABINet*Training Datasets=SL+Wiki+Uber2024.11 | 63.1 | |
| CRNN-pr*Datasets=RL1+RU12024.11 | 56.8 | |
| CRNN-pr*Training Datasets=RL+RU12024.11 | 56.8 | |
| CRNN-ViSuTraining Datasets=SL+RU2024.11 | 47.1 | |
| CRNN†Training Datasets=SL2024.11 | 46.2 |