Co-ordinate-based positional embedding that captures resolution to enhance transformer's performance in medical image

Badhan Kumar Das1,2, Gengyan Zhao3, Saahil Islam4,5

  • 1Digital Technology and Innovation, Siemens Healthineers, Erlangen, Germany. badhankumar.das@siemens-healthineers.com.

Scientific Reports
|April 23, 2024
PubMed
Summary

This study introduces a novel coordinate-based embedding for Vision Transformers (ViTs) in medical imaging. This method enhances infarct segmentation accuracy by preserving spatial resolution and leveraging geometric information.