Video Experimental Relacionado
Updated: Sep 9, 2025

05:49
Author Spotlight: Advancing CBCT and Digital Dental Image Integration with AI-Assisted Digitization
Published on: February 23, 2024
987
Evaluación de la fiabilidad de los grandes modelos de lenguaje basados en IA en el desarrollo de planes de
Makara Sorel1, Chaitanya Gurrala2, Aditya Tadinada1
1Oral and Maxillofacial Radiology, University of Connecticut (UConn) School of Dental Medicine, Farmington, USA.
Cureus
|September 2, 2025
Resumen
Los modelos de lenguaje grande (LLM) de inteligencia artificial (IA) son prometedores para la planificación del tratamiento de ortodoncia. ChatGPT-4o demostró una precisión clínica y un consenso superiores en comparación con Gemini 2.0 Flash Experimental.
Área de la Ciencia:
- La ortodoncia
- Inteligencia artificial
- Apoyo a la decisión clínica
Sus antecedentes:
- La planificación del tratamiento de ortodoncia integra complejos datos dentales, esqueléticos y de tejidos blandos.
- La experiencia clínica y las directrices basadas en la evidencia tradicionalmente informan las decisiones de tratamiento.
- Los avances en IA, específicamente los grandes modelos de lenguaje (LLM), evalúan rápidamente la mejora del flujo de trabajo clínico.
Objetivo del estudio:
- Evaluar la competencia de los LLM basados en IA (ChatGPT-4o y Gemini 2.0 Flash Experimental) en la generación de planes de tratamiento de ortodoncia.
- Comparar la eficacia de diferentes LLM en la creación de estrategias de tratamiento detalladas y completas a partir de datos de casos clínicos.
Principales métodos:
- Se resumieron diez informes de casos de ortodoncia publicados en datos clínicos estandarizados.
- Las entradas fueron introducidas en ChatGPT-4o y Gemini 2.0 Flash Experimental para generar planes de tratamiento.
- Los resultados fueron evaluados de forma independiente por ortodoncistas y un residente de ortodoncia para determinar su exactitud, integridad y pertinencia.
Principales resultados:
- ChatGPT-4o logró una mayor alineación clínica y consenso entre los evaluadores (alfa de Krippendorff = 0,935).
- Gemini 2.0 Flash experimental exhibió una mayor variabilidad y acuerdo moderado (alfa de Krippendorff = 0,692).
- ChatGPT-4o incorporó detalles clínicos más relevantes y se alineó mejor con los estándares basados en la evidencia que Gemini.
Conclusiones:
- Los LLM como ChatGPT-4o y Gemini 2.0 Flash Experimental pueden servir como valiosos complementos en la planificación del tratamiento de ortodoncia.
- Estas herramientas de IA muestran potencial, particularmente para casos de rutina, pero no reemplazan la necesidad de experiencia clínica.
- Se necesita más investigación para explorar todas las capacidades y limitaciones de la IA en ortodoncia.

