@article{240802718, title = {MMIU: Multimodal Multi-image Understanding for Evaluating Large Vision-Language Models}, author = {Fanqing Meng and Jin Wang and Chuanhao Li and Quanfeng Lu and Hao Tian and Jiaqi Liao and Xizhou Zhu and Jifeng Dai and Yu Qiao and Ping Luo and Kaipeng Zhang and Wenqi Shao}, year = {2024}, eprint = {2408.02718}, archivePrefix = {arXiv}, url = {https://arxiv.org/abs/2408.02718v1}, }