哺乳镜中PGMI评估:人工智能软件与人类阅读器对比
T Santner1, C Ruppert2, S Gianolini3
1Medical University of Innsbruck, Fritz-Pregl-Strasse 3, 6020, Innsbruck, Austria.
Radiography (London, England : 1995)
|July 6, 2025
概括
人类读者在哺乳镜质量评估中表现出显著的分歧. 人工智能 (AI) 软件表现出同等或更高的性能,为选程序提供了标准化,客观的质量控制的潜力.
科学领域:
- 放射学 放射学是一门学科.
- 医疗成像医学成像
- 人工智能的人工智能
背景情况:
- 评估乳腺素质对于有效的乳腺癌查至关重要.
- 人类读者在完美-好-中度-不充分 (PGMI) 分类中的变化可能会影响选程序的质量.
- 探索人工智能作为标准化和改进图像质量评估的工具是有必要的.
研究的目的:
- 评估对查性乳房影像的PGMI分类的人类读者间协议.
- 探索人工智能 (AI) 作为乳房影像质量评估的替代阅读器的作用.
主要方法:
- 来自三个欧洲国家的五位X光学家独立评估了520个使用PGMI的乳房图.
- 专门的AI软件被用作第六个阅读器.
- 准确性,科恩的卡帕和混乱矩阵比较了人工智能和人类阅读器的性能.
主要成果:
- 在人类读者中观察到显著的读者间变异性 (κ = -0.018到0.41).
- 人工智能软件在某些特定领域超过了人类的协议,例如腺体组织切割和胸角测量.
- 人工智能性能与人类对其他特征和整体图像质量的评估相当.
结论:
- 在PGMI评估中,人类读者之间的高度分歧凸显了对标准化的需求.
- 人工智能软件显示出对诊断图像质量的可靠,自动评估的潜力.
- 人工智能可以提供客观的反来支持放射学家在质量管理中,尽管工作流集成需要进一步关注.


