@article{lookbeforeactingenhancingvisionfoundatio, title = {Look Before Acting: Enhancing Vision Foundation Representations for Vision-Language-Action Models}, author = {Yulin Luo and Hao Chen and Zhuangzhe Wu and Bowen Sui and Jiaming Liu and Chenyang Gu and Zhuoyang Liu and Qiuxuan Feng and Jiale Yu and Shuo Gu and Peng Jia and Pheng-Ann Heng and Shanghang Zhang}, year = {2026}, eprint = {2603.15618}, archivePrefix = {arXiv}, url = {https://arxiv.org/abs/2603.15618}, }