大型语言模型和皮肤病学人类受访者表现的比较分析

Aravind Baskar Murthy1, Vijayasankar Palaniappan2, Suganya Radhakrishnan2

  • 1Department of Dermatology, Venereology and Leprosy, SRM Medical College Hospital and Research Center, Chengalpet, Tamil Nadu, India.

概括

微软的Bing Chat和ChatGPT在回答皮肤病问题方面表现优于人类受访者. 聊实现了78.2%的准确性,明显超过了ChatGPT (59.8%) 和人类专家 (43%).