Zhedong Zheng,Liang Zheng,Michael Garrett,Yi Yang,Mingliang Xu,Yi Dong Shen.Dual-path Convolutional Image-Text Embeddings with Instance Loss[J].ACM Transactions on Multimedia Computing Communications and Applications,2020.
Kaiyi Lin,Xing Xu,Lianli Gao,Zheng Wang,Heng Tao Shen.Learning Cross-Aligned Latent Embeddings for Zero-Shot Cross-Modal Retrieval[J].Proceedings of the AAAI Conference on Artificial Intelligence,2020.
Wang Liwei,Li Yin,Huang Jing,Lazebnik Svetlana.Learning Two-Branch Neural Networks for Image-Text Matching Tasks.[J].IEEE transactions on pattern analysis and machine intelligence,2019.
Wei Wang,Vincent W. Zheng,Han Yu,Chunyan Miao.A Survey of Zero-Shot Learning: Settings, Methods, and Applications.[J].ACM TIST,2019.
Di Hu,Feiping Nie,Xuelong Li.Deep Binary Reconstruction for Cross-Modal Hashing.[J].IEEE Trans. Multimedia,2019.
Danny Merkx,Stefan L. Frank,Mirjam Ernestus.Language learning using Speech to Image retrieval.[J].CoRR,2019.
Peter Young,Alice Lai,Micah Hodosh,Julia Hockenmaier.From image descriptions to visual denotations: New similarity metrics for semantic inference over event descriptions[J].Transactions of the Association for Computational Linguistics,2014.