优化ChatGPT的诊断性能:快速工程对胸部放射病例的影响
Turay Cesur1, Yasin Celal Güneş2
1Radiology, Ankara Mamak State Hospital, Ankara, TUR.
Cureus
|June 10, 2024
概括
快速工程显著提高了ChatGPT在胸部放射学中的诊断准确度. 定制提示提高了ChatGPT 3.5的性能,缩小了与GPT-4在识别放射病例方面的差距.
科学领域:
- 放射学中的人工智能
- 在医学诊断中使用自然语言处理.
背景情况:
- 最近的研究表明,ChatGPT 3.5和GPT-4具有放射性知识.
- 快速工程对人工智能在放射学诊断性能的影响还不清楚.
研究的目的:
- 调查如何迅速工程影响诊断准确度的ChatGPT 3.5和GPT-4对于胸部放射病例.
- 为了确定即时复杂性是否会影响这些AI模型的性能.
主要方法:
- 124个胸部放射病例的回顾性横截面研究来自胸部放射学学会网站.
- 聊天GPT 3.5和GPT-4在没有提示和五种不同的提示复杂度的情况下进行了测试.
- 模型生成的差异诊断与使用评分系统建立的放射性诊断进行了比较.
主要成果:
- 聊天GPT 3.5的准确性从没有提示的25%提高到有复杂提示的56.5% (P <0.001).
- 在复杂提示的情况下,GPT-4准确度从53.2%提高到59.7% (P = 0.09).
- 在ChatGPT 3.5和GPT-4之间,峰值性能在统计上没有差异 (P = 0.55).
结论:
- 快速工程对于提高放射学AI语言模型的诊断性能至关重要.
- 聊天GPT 3.5 显示了优化提示的显著改进,接近GPT-4的功能.
更多相关视频
07:57Positron Emission Tomography-based Dose Painting Radiation Therapy in a Glioblastoma Rat Model using the Small Animal Radiation Research Platform
Published on: March 24, 2022
2.8K
05:07Author Spotlight: Optimized Lung MRI Protocol with Computationally Efficient Reconstruction Methods
Published on: September 6, 2024
335
