@article{a2dsemanticawarepositionencodingfor, title = {A 2D Semantic-Aware Position Encoding for Vision Transformers}, author = {Xi Chen and Shiyang Zhou and Muqi Huang and Jiaxu Feng and Yun Xiong and Kun Zhou and Biao Yang and Yuhui Zhang and Huishuai Bao and Sijia Peng and Chuan Li and Feng Shi}, year = {2025}, eprint = {2505.09466}, archivePrefix = {arXiv}, url = {https://arxiv.org/abs/2505.09466v1}, }