CLIP4Clip: An empirical study of CLIP for end to end video clip retrieval and captioning

Huaishao Luo(Southwest Jiaotong University), Tianrui Li(Southwest Jiaotong University), Yang Chen(University of Electronic Science and Technology of China), Lei Ji(Chinese Academy of Geological Sciences), Wen Lei(Microsoft Research Asia (China)), Ming Zhong(Microsoft Research Asia (China)), Nan Duan(Microsoft Research Asia (China))
Neurocomputing
July 16, 2022
Cited by 676


Related Papers

UniXcoder: Unified Cross-Modal Pre-training for Code Representation
|Proceedings of the 60th Annual Meeting of the Association for Computational Linguistics (Volume 1: Long Papers)|2022|554
Deep Air Quality Forecasting Using Hybrid Deep Learning Framework
|IEEE Transactions on Knowledge and Data Engineering|2019|467