@article{fromflatlandtospaceteachingvision, title = {From Flatland to Space: Teaching Vision-Language Models to Perceive and Reason in 3D}, author = {Jiahui Zhang and Yurui Chen and Yanpeng Zhou and Yueming Xu and Ze Huang and Jilin Mei and Junhui Chen and Yu-Jie Yuan and Xinyue Cai and Guowei Huang and Xingyue Quan and Hang Xu and Li Zhang}, year = {2025}, eprint = {2503.22976}, archivePrefix = {arXiv}, url = {https://arxiv.org/abs/2503.22976v3}, }