VIDHALLUC:

Chaoyu Li1, Eun Woo Im1, Pooyan Fazli1

  • 1Arizona State University.

Proceedings. IEEE Computer Society Conference on Computer Vision and Pattern Recognition
|September 5, 2025
PubMed
概括

多模式大语言模型 (MLLMs) 在视频幻觉中扎. 我们介绍了VIDHALLUC,一个基准,以及DINO-HEAL,一种提高视频理解MLLM准确性的方法.