@article{largescalevisionlanguagemodelslearn, title = {Vision-Language Models Learn Super Images for Efficient Partially Relevant Video Retrieval}, author = {Taichi Nishimura and Shota Nakada and Masayoshi Kondo}, year = {2023}, eprint = {2312.00414}, archivePrefix = {arXiv}, url = {https://arxiv.org/abs/2312.00414v2}, }