ConTEXTual Net: A Multimodal Vision-Language Model for Segmentation of Pneumothorax

Zachary Huemann1, Xin Tie2, Junjie Hu3

  • 1Department of Radiology, University of Wisconsin-Madison, Madison, WI, 53705, USA. zhuemann@wisc.edu.

Summary

A new model, ConTEXTual Net, uses radiology report text to improve pneumothorax segmentation in chest X-rays. This vision-language approach matches human expert accuracy, outperforming other AI models.