@article{asurveyonvisionlanguageactionmodelsanact, title = {A Survey on Vision-Language-Action Models: An Action Tokenization Perspective}, author = {Yifan Zhong and Fengshuo Bai and Shaofei Cai and Xuchuan Huang and Zhang Chen and Xiaowei Zhang and Yuanfei Wang and Shaoyang Guo and Tianrui Guan and Ka Nam Lui and Zhiquan Qi and Yitao Liang and Yuanpei Chen and Yaodong Yang}, year = {2025}, eprint = {2507.01925}, archivePrefix = {arXiv}, url = {https://arxiv.org/abs/2507.01925}, }