使

Richard Bieck1, Martin Sorge2, Katharina Heuermann2

  • 1Innovation Center Computer Assisted Surgery (ICCAS), Leipzig University, Semmelweisstraße 14, 04103, Leipzig, Germany. Richard.bieck@medizin.uni-leipzig.de.

概括

本研究介绍了用于内镜耳鼻喉手术的视觉语言模型 (VLM),增强图像分类和报告生成. VLM集成视觉和文本数据,优于现有的多任务辅助模型.