Comparing supervised machine learning and large language models in title-abstract screening

Marco F Aigner1, Matthias Ganzinger2, Pascal Probst3,4

  • 1Institute of Medical Informatics, Heidelberg University, Heidelberg, Germany.

Systematic Reviews
|June 9, 2026
PubMed
Summary

Supervised machine learning and large language models show promise for automating systematic review screening, with both achieving high recall comparable to human reviewers. Supervised models offer better specificity, while large language models provide more sensitive, explainable results.

Related Concept Videos