Comparación de ChatGPT y DeepSeek para la Evaluación de Preguntas de Opción Múltiple en Educación Médica Ortopédica:

Chirathit Anusitviwat1, Sitthiphong Suwannaphisit2, Jongdee Bvonpanttarananon1

  • 1Department of Orthopedics, Faculty of Medicine, Prince of Songkla University, 15 Karnchanavanich Road, Hat Yai, 90110, Thailand, 66 74451601.

JMIR formative research
|December 19, 2025
PubMed
Resumen

ChatGPT demostró un rendimiento superior a DeepSeek en la evaluación de preguntas de opción múltiple (POM) en ortopedia, mostrando mayor precisión y tiempos de respuesta más rápidos. Esto sugiere que los modelos de lenguaje grandes (LLM) como ChatGPT pueden ayudar de manera eficiente en las evaluaciones de educación médica.