Evaluating AI Models: Performance Validation Using Formal Multiple-Choice Questions in Neuropsychology.

Alejandro García-Rudolph1,2,3, David Sanchez-Pinsach1,2,3, Eloy Opisso1,2,3

  • 1Departmento de Investigación e Innovación, Institut Guttmann, Institut Universitari de Neurorehabilitació adscrit a la UAB, Badalona, Barcelona, Spain.

Summary

Advanced AI language models show promise for clinical neuropsychology education. GPT-4.0 outperformed GPT-3.5 on board certification-like questions, indicating AI