Video Experimental Relacionado
Updated: Jul 23, 2026

Disruption of Frontal Lobe Neural Synchrony During Cognitive Control by Alcohol Intoxication
Published on: February 6, 2019
Inteligencia artificial frente a evaluación humana de vídeos educativos de anestesia: un análisis comparativo
Kubra Taskin1, Hulya Yilmaz Ak1
1Department of Anesthesiology and Reanimation, Kartal Dr. Lütfi Kırdar City Hospital, University of Health Sciences, Istanbul, Türkiye.
Los vídeos educativos de anestesia creados por humanos en YouTube obtuvieron mejores resultados que los generados por IA. Sin embargo, ChatGPT-5 mostró una fuerte concordancia con los expertos humanos en la evaluación de la calidad del vídeo, lo que sugiere el potencial de la IA para la evaluación de contenidos.
Área de la Ciencia:
- Educación Médica; Inteligencia Artificial; Anestesiología
Sus antecedentes:
- YouTube es una plataforma popular para la educación médica, pero la calidad y la precisión de los vídeos son motivo de preocupación.
- La evaluación tradicional de la calidad se basa en expertos humanos que utilizan escalas como DISCERN, JAMA y GQS.
- Los modelos de lenguaje grandes (LLM) ofrecen nuevas posibilidades para la evaluación de contenido escalable y objetiva.
Objetivo del estudio:
- Comparar la calidad educativa de los vídeos de anestesia producidos por humanos frente a la IA.
- Evaluar la concordancia entre las calificaciones de expertos humanos y las evaluaciones de ChatGPT-5 de la calidad del vídeo.
Principales métodos:
- Se realizó un estudio transversal que analizó 40 vídeos de YouTube sobre anestesia (20 generados por humanos, 20 generados por IA).
- Dos anestesiólogos y ChatGPT-5 evaluaron los vídeos utilizando los criterios DISCERN, JAMA y GQS.
- Se calcularon la fiabilidad interevaluador (ICC) y las correlaciones (rho de Spearman).
Principales resultados:
- Los vídeos generados por humanos superaron significativamente a los vídeos de IA en las puntuaciones DISCERN y JAMA (p < 0,05).
- No se encontró ninguna diferencia significativa en las puntuaciones de la Escala de Calidad Global (GQS).
- ChatGPT-5 demostró una fuerte concordancia con las calificaciones de expertos humanos en todas las escalas (ρ > 0,76, p < 0,001).
Conclusiones:
- Los modelos de IA como ChatGPT-5 muestran la promesa de aproximar el juicio de expertos humanos para la evaluación de contenido educativo.
- Si bien el contenido generado por humanos sobresale en transparencia, el contenido generado por IA es comparable en estructura y fluidez.
- La evaluación asistida por IA puede proporcionar herramientas estandarizadas y eficientes para la selección de archivos de vídeo de educación médica.
Más Videos Relacionados
06:19Integration of Animal Behavioral Assessment and Convolutional Neural Network to Study Wasabi-Alcohol Taste-Smell Interaction
Published on: August 16, 2024
07:28Web-based Clinician Guide to Record Compatible Video of Standardized Drinking Task Kinematics for Computer Vision Analysis
Published on: November 28, 2025