@article{distillingknowledgefromlanguagemodelsfor, title = {Text-Derived Knowledge Helps Vision: A Simple Cross-modal Distillation for Video-based Action Anticipation}, author = {Sayontan Ghosh and Tanvi Aggarwal and Minh Hoai and Niranjan Balasubramanian}, year = {2022}, eprint = {2210.05991}, archivePrefix = {arXiv}, url = {https://arxiv.org/abs/2210.05991v2}, }