@article{vilpactabenchmarkforcompositional, title = {ViLPAct: A Benchmark for Compositional Generalization on Multimodal Human Activities}, author = {Terry Yue Zhuo and Yaqing Liao and Yuecheng Lei and Lizhen Qu and Gerard de Melo and Xiaojun Chang and Yazhou Ren and Zenglin Xu}, year = {2022}, eprint = {2210.05556}, archivePrefix = {arXiv}, url = {https://arxiv.org/abs/2210.05556v4}, }