@article{unemocollaborativevisuallanguagereasonin, title = {UNeMo: Collaborative Visual-Language Reasoning and Navigation via a Multimodal World Model}, author = {Changxin Huang and Lv Tang and Zhaohuan Zhan and Lisha Yu and Runhao Zeng and Zun Liu and Zhengjie Wang and Jianqiang Li}, year = {2025}, eprint = {2511.18845}, archivePrefix = {arXiv}, url = {https://arxiv.org/abs/2511.18845}, }