@article{pinpointingtriggermomentforgroundedvideo, title = {Pinpointing Trigger Moment for Grounded Video QA: Enhancing Spatio-temporal Grounding in Multimodal Large Language Models}, author = {Jinhwan Seo and Yoonki Cho and Junhyug Noh and Sung-eui Yoon}, year = {2025}, eprint = {2511.02182}, archivePrefix = {arXiv}, url = {https://arxiv.org/abs/2511.02182}, }