@article{whenlargevisionlanguagemodelmeetslarge, title = {When Large Vision-Language Model Meets Large Remote Sensing Imagery: Coarse-to-Fine Text-Guided Token Pruning}, author = {Junwei Luo and Yingying Zhang and Xue Yang and Kang Wu and Qi Zhu and Lei Liang and Jingdong Chen and Yansheng Li}, year = {2025}, eprint = {2503.07588}, archivePrefix = {arXiv}, url = {https://arxiv.org/abs/2503.07588v2}, }