Return to Article Details Fine-Grained Video-Text Retrieval via Temporally Aligned Mutually Reinforced Cross-Modal Learning
Download