MGTR-MISS:

Jiayu Zhang1, Pengjie Tang1, Yunlan Tan1

  • 1Key Laboratory of Electronic Data Control and Evidence Collection in Jiangxi Province, Jinggangshan University, Ji'an 343009, PR China; College of Electronics & Information Engineering, Jinggangshan University, Ji'an 343009, PR China.

概括

本研究介绍了MGTR-MISS,这是一种通过整合视觉和语言信息来生成准确的视频描述的新型模型. 它显著提高了对基准数据集的视频标题性能.

相关概念视频