一个眼科视频基础模型用于手术识别和导航,使用湿实验室猪眼验证
Puxun Tu1, Ce Zheng2, Xiaoling Xie3
1Institute of Biomedical Manufacturing and Life Quality Engineering, School of Mechanical Engineering, Shanghai Jiao Tong University, Shanghai, China.
Nature biomedical engineering
|March 3, 2026
概括
一个新的眼科视频基础模型 (OVFM) 使用人工智能分析手术视频. 这种人工智能工具提高了手术性能,并实时减少了技能差距,为未来的手术应用显示了希望.
科学领域:
- 人工智能的人工智能
- 眼科医生 眼科 眼科
- 手术技术 手术技术
背景情况:
- 人工智能基础模型正在通过大规模数据预训练改变医疗保健.
- 术内人工智能应用受到稀缺的外科数据和实时部署挑战的限制.
研究的目的:
- 开发一个眼科视频基础模型 (OVFM) 用于微观眼科手术识别和导航.
- 为了实现手术中的实时手术内人工智能部署.
主要方法:
- 使用自主监督的视频变压器开发了OVFM.
- 在140种类型的眼科手术视频片段中接受过OVFM培训的110万名眼科医生.
- 应用知识蒸用于手术显微镜的实时部署.
主要成果:
- 在七个下游任务中,OVFM表现出卓越的性能.
- 在模拟白内障手术中,OVFM驱动系统提高了手术性能.
- 该系统减少了不同经验水平的外科医生的技能差距.
结论:
- OVFM有效地学习了眼科手术的时空特征.
- 知识蒸使人工智能模型的实用实时内操作部署成为可能.
- 在多个外科领域,OVFM显示了实时外科辅助和培训的巨大潜力.


