在估计基于深度学习的计算机辅助系统对精神疾病的诊断性能时,存在数据泄露的风险
Hyung-Tak Lee1,2, Hye-Ran Cheon1,2, Seung-Hwan Lee3,4
1Department of Electronics and Information Engineering, Korea University, Sejong, Republic of Korea.
Scientific reports
|October 3, 2023
概括
正确的交叉验证对于神经成像中准确的深度学习至关重要. 由于数据泄露,试验智能交叉验证 (tCV) 等不正确的方法会增加诊断性能,而学科智能交叉验证 (sCV) 为计算机辅助诊断 (CAD) 系统提供可靠的结果.
科学领域:
- 神经科学是一个神经科学.
- 人工智能的人工智能
- 医疗成像医学成像
背景情况:
- 深度学习 (DL) 和数据增强在基于神经成像的计算机辅助诊断 (CAD) 中很常见.
- 适当的交叉验证 (CV) 对于防止由于数据泄露而导致的膨胀性能至关重要,但在DL-CAD研究中经常被忽视.
- 经常使用来自创伤后应激障碍 (PTSD) 患者和对照者的休息状态电脑电图 (EEG) 数据.
研究的目的:
- 调查正确与不正确的CV方法对数据增强后基于DL的CAD系统性能的影响.
- 评估不同CV策略如何影响神经成像分析中的诊断准确性.
- 突出适当的简历的重要性,以便在精神疾病中可靠地开发DL模型.
主要方法:
- 从PTSD患者和健康对照中增强休息状态EEG数据,使用剪切方法.
- 应用了四种CV方法:主体智能的CV (sCV),重叠的sCV (oSCV),试验智能的CV (tCV) 和重叠的tCV (otCV).
- 使用两个卷积神经网络 (CNN) 模型评估诊断性能.
主要成果:
- 数据增强在所有CV方法中提高了性能.
- 错误的CV方法 (tCV,otCV) 导致由于数据泄露导致诊断性能膨胀.
- 正确的CV方法 (sCV,oSCV) 产生了更可靠的性能估计.
结论:
- 根据主体的CV (sCV) 和重叠的sCV (oSCV) 对于开发可靠的DL基于CAD系统至关重要.
- 研究人员必须使用正确的CV方法来避免数据泄露,并确保准确的诊断性能评估.
- 这项研究为开发基于神经成像的CAD系统用于使用DL与数据增强的精神疾病提供了关键的见解.


