Large language models for the screening step in systematic reviews in dentistry

Rata Rokhshad1, Mobina Bagherianlemraski2, Sarah Sadat Ehsani3

  • 1Department of Pediatric Dentistry, Loma Linda School of Dentistry, Loma Linda, USA.

PubMed
Summary

Chatbots demonstrated limited accuracy and low agreement in screening studies for systematic reviews, particularly in AI-driven tooth segmentation on dental radiographs. Human oversight remains essential for maintaining review integrity.