@article{tokencomvisionlanguagemodelformultimodal, title = {TokenCom: Vision-Language Model for Multimodal and Multitask Token Communications}, author = {Feibo Jiang and Siwei Tu and Li Dong and Xiaolong Li and Kezhi Wang and Cunhua Pan and Zhu Han and Jiangzhou Wang}, year = {2026}, eprint = {2603.00482}, archivePrefix = {arXiv}, url = {https://arxiv.org/abs/2603.00482}, }