GPT-4 查询科学出版物的性能:说明书的可复制性,准确性和影响

Kaiming Tao1, Zachary A Osman1, Philip L Tzou1

  • 1Division of Infectious Diseases, Department of Medicine, Stanford University, Stanford, CA, USA.

概括

大型语言模型 (LLM) 在回答有关HIV耐药性论文的问题时表现出高准确度. 然而,使用说明书并没有提高性能,这表明需要先进的方法来进行专门的科学文献审查.