DICCR:

Dongming Zhou1, Jinsheng Deng2, Zhengbin Pang1

  • 1School of Computer Science, National University of Defense Technology, Deya Road, Changsha, 410003, Hunan, China.

概括

本研究引入了一种新的视觉语言导航 (VLN) 方法,使用因果推理来减少多模式偏差. DICCR模型通过解决视觉和文本指令之间的虚假相关性来提高导航性能.