Video Experimental Relacionado
Updated: Jan 21, 2026

Comparing Objective Conjunctival Hyperemia Grading and the Ocular Surface Disease Index Score in Dry Eye Syndrome During COVID-19
Published on: May 25, 2022
Estimación de las puntuaciones IPSS y OABSS mediante ChatGPT-4o: un estudio de validación comparativo en Corea
Hoyoung Bae1,2, Gyu Min Lee1,2, Jiehyeon Lee1,2
1Department of Urology, Seoul National University Boramae Medical Center, Sindaebang 2(i)-dong, Dongjak-gu, Seoul, 07061, Korea.
ChatGPT-4o demostró una precisión moderada en la estimación de la Puntuación Internacional de Síntomas de Próstata (IPSS) y la Puntuación de Síntomas de Vejiga Hiperactiva (OABSS), mostrando potencial para ayudar en la recopilación de datos clínicos.
Área de la Ciencia:
- Inteligencia Artificial en Salud
- Urología
- Informática Clínica
Sus antecedentes:
- Las medidas de resultados informadas por los pacientes (PROMs) como la Puntuación Internacional de Síntomas de Próstata (IPSS) y la Puntuación de Síntomas de Vejiga Hiperactiva (OABSS) son cruciales para el diagnóstico y manejo de los síntomas del tracto urinario inferior (LUTS) y la vejiga hiperactiva (OAB).
- La puntuación precisa de los síntomas depende del recuerdo del paciente y de la cumplimentación del cuestionario, lo que puede estar sujeto a errores u omisiones.
- Los modelos de lenguaje grandes (LLM) como ChatGPT-4o ofrecen una nueva vía potencial para la extracción y el análisis de datos de notas clínicas.
Objetivo del estudio:
- Evaluar el rendimiento de ChatGPT-4o en la estimación de IPSS y OABSS utilizando descripciones en lenguaje natural y registros completos de pacientes ambulatorios.
- Comparar las puntuaciones generadas por IA con las puntuaciones reales de los cuestionarios informadas por los pacientes.
Principales métodos:
- Un estudio que involucró a 91 pacientes, de los cuales 52 completaron IPSS y 77 completaron OABSS.
- ChatGPT-4o procesó las declaraciones de síntomas de los pacientes palabra por palabra y los registros médicos escritos por urólogos.
- Los análisis estadísticos incluyeron pruebas t pareadas, kappa de Cohen, correlación de Spearman, gráficos de Bland-Altman, prueba de McNemar y análisis de la curva ROC para la comparación de puntuaciones y la clasificación diagnóstica.
Principales resultados:
- ChatGPT-4o subestimó la IPSS media (11,2 frente a 13,6, p=0,006) pero no mostró diferencias significativas para la OABSS (6,99 frente a 6,86, p=0,686).
- Se observó una alta concordancia diagnóstica para LUTS (AUC 0,81) y OAB (AUC 0,91), con buena concordancia en la calidad de vida y la incontinencia de urgencia.
- Los coeficientes de correlación de Spearman fueron de 0,60 para IPSS y 0,70 para OABSS, lo que indica correlaciones de moderadas a fuertes.
Conclusiones:
- ChatGPT-4o logró una precisión moderada y clínicamente aceptable en la estimación de IPSS y OABSS.
- El rendimiento de la clasificación diagnóstica de la IA fue comparable a las puntuaciones reales, especialmente para OABSS y la calidad de vida.
- ChatGPT-4o muestra ser una herramienta complementaria a los cuestionarios tradicionales, especialmente cuando los datos del paciente están incompletos.
Más Videos Relacionados
15:49Flexible Colonoscopy in Mice to Evaluate the Severity of Colitis and Colorectal Tumors Using a Validated Endoscopic Scoring System
Published on: October 16, 2013
06:14In Vivo Protocol of Controlled Subconcussive Head Impacts for the Validation of Field Study Data
Published on: April 18, 2019
Videos de Conceptos Relacionados
Reliability and Validity
Imaging Studies for Cardiovascular System VI: Calcium -Scoring CT
Introduction to z Scores
z scores...
Introduction to z Scores
z scores...
z Scores and Area Under the Curve
What are Estimates?
The estimate for the mean of a sample is denoted by ͞x, whereas the mean of the population is designated as μ. Further, parameters such...