,-

Wanru Du1,2, Xiaochuan Jing2, Quan Zhu1,2

  • 1China Aerospace Academy of Systems Science and Engineering, Beijing 100048, China.

概括

本研究引入了一种新的文本视频检索跨模式模型,重点关注详细的框架文本对齐. 拟议的方法通过考虑全球主题和具体细节来提高视频理解,从而提高匹配准确度.

相关概念视频