Adapting multilingual vision language transformers for low-resource Urdu optical character recognition (OCR).

Musa Dildar Ahmed Cheema1, Mohammad Daniyal Shaiq1, Farhaan Mirza2

  • 1Department of Artificial Intelligence and Data Science, National University of Computer and Emerging Sciences, Islamabad, Pakistan.

PubMed
Summary

This study introduces ViLanOCR, a bilingual optical character recognition (OCR) system for Urdu and English. It uses advanced transformer models to achieve state-of-the-art results for low-resource language digitization.