评估人工智能聊天机器人用于口腔和面放射学的患者教育
Dilek Helvacioglu-Yigit1, Husniye Demirturk2, Kamran Ali1
1College of Dental Medicine, QU Health, Qatar University, Doha, Qatar.
概括
人工智能 (AI) 聊天机器人为口腔和 maksillofacial 放射 (OMR) 问题提供了足够的科学答案,但它们的可读性需要改进. 专家验证对于使用人工智能生成的内容进行安全有效的患者教育至关重要.
科学领域:
- 放射学 放射学是一门学科.
- 人工智能的人工智能
- 医学教育 医学教育
背景情况:
- 公共可用的AI聊天机器人越来越多地用于健康信息.
- 评估人工智能聊天机器人对于口腔和上面部放射学 (OMR) 等专业领域的患者教育的适用性至关重要.
- 目前的AI响应可能在质量和可读性方面有所不同.
研究的目的:
- 为了比较AI聊天机器人的质量和可读性,AI聊天机器人对OMR中常见问题 (FAQ) 的回答.
- 评估AI聊天机器人 (ChatGPT-3.5,Gemini 1.5 Pro,Copilot) 在OMR患者教育中的适用性.
- 评估人工智能产生的内容的科学充分性,易懂性和读者满意度.
主要方法:
- 从患者信息网站中选择了15个OMR常见问题.
- 响应是使用ChatGPT-3.5,Gemini 1.5 Pro和Copilot生成的.
- 三名OMR专家评估了科学充分性和可读性 (FKGL,FRE分数) 的答案.
- 统计分析包括威尔科克森签名等级测试和弗莱斯卡帕系数,用于评估者之间的协议.
主要成果:
- 人工智能聊天机器人和专业网站之间没有发现科学充分性的显著差异.
- 人工智能聊天机器人实现了Flesch-Kincaid平均成绩水平 (FKGL) 的12.97和Flesch阅读易度 (FRE) 的34.11.
- 观察到高度的相互评估者协议,表明可靠的评估.
结论:
- 人工智能聊天机器人展示了回答OMR常见问题的潜力,但需要医疗保健专业人员进行验证.
- 确保患者安全和改善护理需要对人工智能生成的健康信息进行专家审查.
- 人工智能聊天机器人和网站的内容可读性需要高级阅读水平,这对一般患者的理解构成挑战.


