@article{cavevlmcotaninterpretablevisionlanguagem, title = {CaVe-VLM-CoT: An Interpretable Vision-Language Model Framework}, author = {Sneha Rao and Shaina Raza and Dhanesh Ramachandram}, year = {2026}, eprint = {2606.18385}, archivePrefix = {arXiv}, url = {https://arxiv.org/abs/2606.18385}, }