@article{inferencecomputeoptimalvideovision, title = {Inference Compute-Optimal Video Vision Language Models}, author = {Peiqi Wang and Shengyun Peng and Xuewen Zhang and Hanchao Yu and Yibo Yang and Lifu Huang and Fujun Liu and Qifan Wang}, year = {2025}, eprint = {2505.18855}, archivePrefix = {arXiv}, url = {https://arxiv.org/abs/2505.18855v1}, }