Scene Text Recognition on ArT
84.9AccuracyViSu
Evaluation Results
| Method | Links | |
|---|---|---|
| ViSuDatasets=RL+RU2024.11 | 84.9 | |
| ParSeq†Datasets=RL2024.11 | 83.1 | |
| CLIP-OCR†Datasets=RL2024.11 | 82.7 | |
| LPV†Datasets=RL2024.11 | 82.4 | |
| TRBA-cr†Datasets=RL+RU2024.11 | 81.9 | |
| MGP†Datasets=RL2024.11 | 79.6 | |
| Baseline-ViSuTraining Datasets=SL+RU2024.11 | 78.8 | |
| LISTER†Datasets=RL2024.11 | 78.3 | |
| BaselineTraining Datasets=SL2024.11 | 74.7 | |
| TRBA-cr*Training Datasets=SL+RU22024.11 | 73.3 | |
| TRBA-ViSuTraining Datasets=SL+RU2024.11 | 72.8 | |
| TRBA-cr†Training Datasets=SL+RU2024.11 | 72 | |
| ParSeqTraining Datasets=SL2024.11 | 70.7 | |
| CLIP-OCRTraining Datasets=SL2024.11 | 70.5 | |
| LISTER*Training Datasets=SL2024.11 | 70.1 | |
| TRBA†Training Datasets=SL2024.11 | 69.9 | |
| MGP*Training Datasets=SL2024.11 | 69 | |
| ABINet*Training Datasets=SL+Wiki+Uber2024.11 | 68.3 | |
| TRBA-pr*Datasets=RL1+RU12024.11 | 66.8 | |
| TRBA-pr*Training Datasets=RL+RU12024.11 | 66.8 | |
| CRNN-ViSuTraining Datasets=SL+RU2024.11 | 61.7 | |
| CRNN†Training Datasets=SL2024.11 | 58.8 | |
| CRNN-pr*Datasets=RL1+RU12024.11 | 58.6 | |
| CRNN-pr*Training Datasets=RL+RU12024.11 | 58.6 |