聊天GPT与经验丰富的眼科医生:评估聊天机器人的眼科写作表现
Gabriel Katz1,2, Ofira Zloto3,4, Avner Hostovsky1,2
1Faculty of Medical & Health Sciences, Tel Aviv University, Tel Aviv, Israel.
Eye (London, England)
|April 1, 2025
概括
聊天GPT可以写科学眼科介绍,与人类专家相提并论. 专家们无法可靠地区分人工智能生成的文本和人类撰写的介绍,这表明ChatGPT.
科学领域:
- 眼科医生 眼科 眼科
- 人工智能在医学中的应用
- 科学写作 科研写作
背景情况:
- 人工智能 (AI) 的快速发展需要在专业的科学领域评估其能力.
- 评估人工智能在产生科学内容中的作用对于了解其对研究和出版物的潜在影响至关重要.
研究的目的:
- 评估ChatGPT在编写眼科研究论文科学介绍方面的熟练程度.
- 将ChatGPT生成的介绍与经验丰富的眼科医生撰写的介绍的质量进行比较.
主要方法:
- 聊天GPT 4被提示为选定的眼科论文生成介绍.
- 十位经验丰富的眼科专家评估了由ChatGPT和人类作者撰写的介绍,而不知道来源.
- 评估的重点是包括语言,数据排列,事实准确性,原创性和数据货币在内的指标.
主要成果:
- 眼科专家仅在57.7%的病例中正确确定了引入的来源.
- 在评估的质量指标中,在ChatGPT和人类作者之间没有发现显著差异.
- 错误分类率因子专业而异,眼镜塑料具有最高的 (66.7%) 和视网膜最低的 (11.1%).
结论:
- 聊天GPT在生成眼科科学论文介绍方面表现出显著的能力.
- 在关键质量方面,人工智能生成的介绍在统计学上与专家撰写的介绍是不可区分的.
- 进一步的研究应该探索AI在其他手稿部分的实用性,并解决道德方面的影响.
更多相关视频
03:14Augmenting Large Language Models via Vector Embeddings to Improve Domain-Specific Responsiveness
Published on: December 6, 2024
466
11:12Driving Simulation in the Clinic: Testing Visual Exploratory Behavior in Daily Life Activities in Patients with Visual Field Defects
Published on: September 18, 2012
17.3K
