@article{matvlmhybridmambatransformerforefficient, title = {MaTVLM: Hybrid Mamba-Transformer for Efficient Vision-Language Modeling}, author = {Yingyue Li and Bencheng Liao and Wenyu Liu and Xinggang Wang}, year = {2025}, eprint = {2503.13440}, archivePrefix = {arXiv}, url = {https://arxiv.org/abs/2503.13440v1}, }