Enhancing waste recognition with vision-language models: A prompt engineering approach for a scalable solution

Hiranya Jeet Malla1, Milad Bazli2, Mehrdad Arashpour1

  • 1Department of Civil Engineering, Monash University, Melbourne, VIC 3800, Australia.

Summary

Vision-Language Models (VLMs) offer a scalable solution for waste image classification, outperforming traditional methods. Targeted prompt engineering significantly boosts VLM accuracy, even in data-scarce scenarios.