评估人工智能的可靠性和临床实用性,用于第一季度产前查和非侵入性产前检测
İbrahim Taşkum1, Selcan Sınacı2, Seyhun Sucu2
1Department of Obstetrics and Gynecology, Gaziantep City Hospital, Gaziantep, Turkey. ibrahimtaskum@gmail.com.
Scientific reports
|November 21, 2025
概括
像ChatGPT-4o这样的人工智能 (AI) 工具在产前护理咨询中显示出有前途的前期查和非侵入性产前检测 (NIPT) 的结合. 虽然可靠,特别是在高风险情况下,人工智能性能需要改进,以保持一致的使用.
科学领域:
- 孕产妇和胎儿医学 孕产妇和胎儿医学
- 临床产科 临床产科
- 医疗保健中的人工智能
背景情况:
- 人工智能 (AI) 工具正在产前护理中出现,但它们对第一季度查咨询的临床实用性尚未确立.
- 医疗保健提供者需要可靠的人工智能支持,以便在结合第一季度查和非侵入性产前检测 (NIPT) 上为患者提供知情咨询.
研究的目的:
- 评估ChatGPT-4o响应的可靠性,可读性和临床实用性,以支持临床医生在产前查咨询中.
- 在第一季度查场景中,评估AI在不同风险分层级别的性能.
主要方法:
- 用了15个风险分层的临床场景来促使ChatGPT-4o.
- 14名围产科医生使用mDISCERN和全球质量表 (GQS) 评价了AI反应.
- 使用五个指数评估可读性;使用ICC和Cronbach的alpha评估可靠性.
主要成果:
- 聊天GPT-4o响应显示了高的评价者间可靠性 (ICC=0.998) 和内部一致性 (α=0.975).
- 在高风险场景中观察到更高的GQS和mDISCERN得分.
- 可读性在不同风险级别之间没有显著变化,也没有与质量分数相关.
结论:
- 聊天GPT-4o显示出作为临床决策支持工具的潜力,用于产前查咨询,特别是在高风险情况下.
- 需要进一步开发,以确保在产前护理中的所有风险级别中保持一致的AI性能.


