@article{embodied3dbenchbenchmarkinglowlevelembod, title = {Embodied3DBench: Benchmarking Low-Level Embodied Spatial Intelligence of Vision Language Models}, author = {Jiyao Zhang and Mingxu Zhang and Yitong Peng and Haoxuan Liu and Chenshuo Wang and Yuxing Long and Haoyang Huang and Dongjiang Li and Nan Duan and Hui Shen and Hao Dong}, year = {2026}, eprint = {2605.29074}, archivePrefix = {arXiv}, url = {https://arxiv.org/abs/2605.29074}, }