Ning Ma1, Shu Yang2, Yizhao Zhou3

  • 1Department of Electrical and Electronic Engineering, The Hong Kong Polytechnic University Hong Kong, Hong Kong.

概括

这项研究引入了一种用于手术视频生成的新型扩散模型,可以从文本和图像提示程序创建高质量的视频. 该模型增强了下游任务,如手术阶段识别.