Large language model-generated versus teacher-written objective structured clinical examination stations for medical

Piotr Szychowiak1, Jonathan Wong-So1, Hélène Messet1

  • 1Médecine Intensive Réanimation, Centre Hospitalier Universitaire d'Orléans, Orleans, France.

Summary

Large language models (LLMs) show potential for creating objective structured clinical examination (OSCE) stations, but GPT-4o requires significant teacher review for reliable assessment grids and overall quality.