@article{crossmodalcontextawarelearningforvisualp, title = {Cross-modal Context-aware Learning for Visual Prompt Guided Multimodal Image Understanding in Remote Sensing}, author = {Xu Zhang and Jiabin Fang and Zhuoming Ding and Jin Yuan and Xuan Liu and Qianjun Zhang and Zhiyong Li}, year = {2025}, eprint = {2512.11680}, archivePrefix = {arXiv}, url = {https://arxiv.org/abs/2512.11680}, }