:

Hiranya Jeet Malla1, Milad Bazli2, Mehrdad Arashpour1

  • 1Department of Civil Engineering, Monash University, Melbourne, VIC 3800, Australia.

概括

视觉语言模型 (VLMs) 为废物图像分类提供了可扩展的解决方案,优于传统方法. 有针对性的提示工程显著提高了VLM的准确性,即使在数据稀缺的场景.