@article{echoinkr1exploringaudiovisualreasoning, title = {EchoInk-R1: Exploring Audio-Visual Reasoning in Multimodal LLMs via Reinforcement Learning}, author = {Zhenghao Xing and Xiaowei Hu and Chi-Wing Fu and Wenhai Wang and Jifeng Dai and Pheng-Ann Heng}, year = {2025}, eprint = {2505.04623}, archivePrefix = {arXiv}, url = {https://arxiv.org/abs/2505.04623v1}, }