:

Esther Helene Stueker1, Fiona R Kolbinger2,3,4, Oliver Lester Saldanha1

  • 1Else Kröner Fresenius Center for Digital Health, Dresden University of Technology, Dresden, Germany.

概括

视觉语言模型 (VLMs) 显示了外科手术文档的前景. GPT-4o和Gemini-1.5-pro可靠地检测到手术工具和分类程序,尽管分类病理需要进一步开发.