@article{goal2pixelgroundinggoalstopixelsforvisio, title = {Goal2Pixel: Grounding Goals to Pixels for Vision-Language Navigation}, author = {Muyi Bao and Yuxin Cai and Hang Xu and Zongtai Li and Jinxi He and Jingfan Tang and Chen Lv and Ji Zhang and Yaqi Xie and Wenshan Wang}, year = {2026}, eprint = {2606.01621}, archivePrefix = {arXiv}, url = {https://arxiv.org/abs/2606.01621}, }