@article{enhancingvisuallanguagemodalityalignment, title = {Enhancing Visual-Language Modality Alignment in Large Vision Language Models via Self-Improvement}, author = {Xiyao Wang and Jiuhai Chen and Zhaoyang Wang and YuHang Zhou and Yiyang Zhou and Huaxiu Yao and Tianyi Zhou and Tom Goldstein and Parminder Bhatia and Furong Huang and Cao Xiao}, year = {2024}, eprint = {2405.15973}, archivePrefix = {arXiv}, url = {https://arxiv.org/abs/2405.15973v3}, }