@article{bymyeyesgroundingmultimodallarge, title = {By My Eyes: Grounding Multimodal Large Language Models with Sensor Data via Visual Prompting}, author = {Hyungjun Yoon and Biniyam Aschalew Tolera and Taesik Gong and Kimin Lee and Sung-Ju Lee}, year = {2024}, eprint = {2407.10385}, archivePrefix = {arXiv}, url = {https://arxiv.org/abs/2407.10385v2}, }