Related Experiment Videos

OCR-mediated modality dominance in vision-language models: implications for radiology AI trustworthiness

Izzet Turkalp Akbasli1,2, Baris Ozturk3, Oguzhan Serin2,4

  • 1Hacettepe University Faculty of Medicine, Department of Pediatric Intensive Care Medicine, Ankara, Turkey.

Summary

Vision-language models (VLMs) are vulnerable to security risks in radiology due to optical character recognition (OCR)-capable text injection. Adversarial text can override image data, compromising diagnostic accuracy and requiring robust system-level safeguards.