When language and vision meet road safety: Leveraging multimodal large language models for video-based traffic

Ruixuan Zhang1, Beichen Wang2, Juexiao Zhang2

  • 1Tandon School of Engineering, New York University, Brooklyn, United States.

Related Concept Videos