AI-generated biochemistry test item parameters in MST test conditions

Murat Polat1,2, Engin Karadag3,4

  • 1Anadolu University, Eskisehir, Turkey.

BMC Medical Education
|December 22, 2025
PubMed
Summary

ChatGPT 4o shows moderate accuracy in estimating medical assessment item difficulty but systematically overestimates. Further calibration and oversight are needed for AI in medical education assessments.