VIDHALLUC:

Chaoyu Li1, Eun Woo Im1, Pooyan Fazli1

  • 1Arizona State University.

Proceedings. IEEE Computer Society Conference on Computer Vision and Pattern Recognition
|September 5, 2025
PubMed
まとめ

マルチモダルの大きな言語モデル (MLLMs) は ビデオ幻覚と闘っています ビデオ理解におけるMLLMの精度を向上させる方法であるDINO-HEALを紹介しています.