@article{positionenhancedvisualinstructiontuning, title = {Position-Enhanced Visual Instruction Tuning for Multimodal Large Language Models}, author = {Chi Chen and Ruoyu Qin and Fuwen Luo and Xiaoyue Mi and Peng Li and Maosong Sun and Yang Liu}, year = {2023}, eprint = {2308.13437}, archivePrefix = {arXiv}, url = {https://arxiv.org/abs/2308.13437v2}, }