@article{visionlanguagemodelsareblind, title = {Vision language models are blind: Failing to translate detailed visual features into words}, author = {Pooyan Rahmanzadehgervi and Logan Bolton and Mohammad Reza Taesiri and Anh Totti Nguyen}, year = {2024}, eprint = {2407.06581}, archivePrefix = {arXiv}, url = {https://arxiv.org/abs/2407.06581v6}, }