Mutual contextual relation-guided dynamic graph networks for cross-modal image-text retrieval.

G Sucharitha1, B J D Kalyani2, Akella S Narasimha Raju3

  • 1Department of Computer Science and Engineering, Anurag University, Hyderabad, Telangana, India. sucharithasu@gmail.com.

Scientific Reports
|October 1, 2025
PubMed
Summary

This study introduces a novel dynamic graph network for cross-modal retrieval, enhancing image-text matching by modeling mutual contextual relations. The approach significantly improves precision and recall in retrieving semantically relevant content across modalities.