@article{vegalearninginterleavedimagetext, title = {VEGA: Learning Interleaved Image-Text Comprehension in Vision-Language Large Models}, author = {Chenyu Zhou and Mengdan Zhang and Peixian Chen and Chaoyou Fu and Yunhang Shen and Xiawu Zheng and Xing Sun and Rongrong Ji}, year = {2024}, eprint = {2406.10228}, archivePrefix = {arXiv}, url = {https://arxiv.org/abs/2406.10228v1}, }