Louis Z Cai1, Abdulla Shaheen1, Andrew Jin2

  • 1From the Bascom Palmer Eye Institute, Miami, Florida, USA (L.Z.C., A.S., J.S.Y., N.Y., C.A.).

概括

像ChatGPT-4.0和Bing Chat这样的生成人工智能模型在板式问题上显示出与人类眼科医生的准确性相比较的准确性. 然而,这些大型语言模型 (LLM) 仍然需要改进,以减少幻觉和增强推理.