@article{mllmsulmultimodallargelanguagemodelfor, title = {MLLM-SUL: Multimodal Large Language Model for Semantic Scene Understanding and Localization in Traffic Scenarios}, author = {Jiaqi Fan and Jianhua Wu and Jincheng Gao and Jianhao Yu and Yafei Wang and Hongqing Chu and Bingzhao Gao}, year = {2024}, eprint = {2412.19406}, archivePrefix = {arXiv}, url = {https://arxiv.org/abs/2412.19406v1}, }