Video Experimental Relacionado
Updated: Jan 7, 2026

05:15
Grossing of Non-neoplastic Globes, Including Fetal Eyes
Published on: May 30, 2025
454
Rendimiento de ChatGPT en un examen de patología forense especializado: implicaciones para patólogos forenses y no
Hans H de Boer1,2, Gregory Young3,4, Heinrich Bouwer3,4
1Department of Forensic Medicine, Monash University, 65 Kavanagh Street, Southbank, VIC, 3006, Australia. hans.de.boer@vifm.org.
International journal of legal medicine
|December 28, 2025
Resumen
Los modelos de lenguaje de inteligencia artificial (IA), como ChatGPT, destacan en el recuerdo de hechos de patología forense, pero tienen dificultades con el razonamiento complejo y la interpretación de imágenes. Sus resultados, seguros pero inexactos, requieren la revisión de expertos para aplicaciones médicas seguras.
Área de la Ciencia:
- Informática Médica
- Patología Forense
- Inteligencia Artificial
Sus antecedentes:
- El creciente uso de modelos de lenguaje de IA (LLM) en medicina plantea preocupaciones sobre la precisión, el razonamiento y la seguridad.
- La patología forense exige un razonamiento equilibrado, sensibilidad contextual y comunicación precisa, lo que hace que la evaluación de LLM sea fundamental.
Objetivo del estudio:
- Evaluar las capacidades y limitaciones de ChatGPT en patología forense.
- Comprender los riesgos y beneficios más amplios del uso de LLM en aplicaciones médicas.
Principales métodos:
- Se evaluó ChatGPT-4.5 Turbo utilizando un examen simulado de becas de patología forense del Royal College of Pathologists of Australasia.
- El examen incluyó preguntas de ensayo, tareas basadas en imágenes e informes de casos.
- Las respuestas fueron calificadas a ciegas por examinadores experimentados según la precisión, el razonamiento y la comunicación.
Principales resultados:
- ChatGPT tuvo un buen desempeño en preguntas de ensayo basadas en conocimientos, pero un mal desempeño en tareas que requerían razonamiento complejo o interpretación de imágenes.
- El modelo generó resultados fluidos y persuasivos, creando a menudo una falsa impresión de precisión.
- La precisión fáctica fue inconsistente, particularmente para análisis dependientes del contexto.
Conclusiones:
- ChatGPT puede reproducir el conocimiento establecido de patología forense, pero carece de habilidades de razonamiento de nivel superior.
- Los resultados engañosamente seguros plantean un riesgo, especialmente para los no especialistas.
- El uso de LLM en patología forense requiere una cuidadosa supervisión experta y solo es adecuado para tareas administrativas o educativas de bajo riesgo.

