@article{vilmaazeroshotbenchmarkforlinguistic, title = {ViLMA: A Zero-Shot Benchmark for Linguistic and Temporal Grounding in Video-Language Models}, author = {Ilker Kesen and Andrea Pedrotti and Mustafa Dogan and Michele Cafagna and Emre Can Acikgoz and Letitia Parcalabescu and Iacer Calixto and Anette Frank and Albert Gatt and Aykut Erdem and Erkut Erdem}, year = {2023}, eprint = {2311.07022}, archivePrefix = {arXiv}, url = {https://arxiv.org/abs/2311.07022v1}, }