Advanced Prompting Techniques Informed by Clinical Expertise Improve the Accuracy of LLM Data Extraction but Increase

Yifei Wang1, Alejandro Alejandrez Cisneros2, Carly Stewart3

  • 1Department of Epidemiology and Biostatistics, University of California San Francisco, San Francisco, CA, USA. yifei.wang@ucsf.edu.

Summary

Prompt engineering for generative AI in medical text classification shows promise. External knowledge sources improve accuracy, while chain-of-thought and recursive criticism boost sensitivity but increase non-determinism.