@article{unifyingspecializedvisualencodersfor, title = {Unifying Specialized Visual Encoders for Video Language Models}, author = {Jihoon Chung and Tyler Zhu and Max Gonzalez Saez-Diez and Juan Carlos Niebles and Honglu Zhou and Olga Russakovsky}, year = {2025}, eprint = {2501.01426}, archivePrefix = {arXiv}, url = {https://arxiv.org/abs/2501.01426v1}, }