Prompt injection attacks on vision-language models for surgical decision support

Zheyuan Zhang1, Muhammad Ibtsaam Qadir1, Matthias Carstens1,2

  • 1Weldon School of Biomedical Engineering, Purdue University, West Lafayette, IN, USA.

Summary

Vision-language models show promise for surgical AI but are vulnerable to prompt injection attacks. Robustness varies, with Gemini 2.5 Pro demonstrating greater resilience than GPT-o4-mini-high, highlighting the need for safety measures.