¿Pueden los modelos de lenguaje grandes ser una herramienta viable para los grupos de trabajo de consenso?

Frank G Lee1, Ellen L Larson1, Jane Vermunt1

  • 1Division of Colon and Rectal Surgery, Mayo Clinic, Rochester, Minnesota.

PubMed
Resumen

OpenEvidence demostró una calidad superior en la adecuación del contenido y la calidad de las citas en comparación con Gemini y ChatGPT en un estudio sobre la síntesis de literatura sobre ventrorectopexia. Los expertos no pudieron distinguir el texto generado por el chatbot del consenso humano.