@article{whenlanguageandvisionmeetroadsafety, title = {When language and vision meet road safety: leveraging multimodal large language models for video-based traffic accident analysis}, author = {Ruixuan Zhang and Beichen Wang and Juexiao Zhang and Zilin Bian and Chen Feng and Kaan Ozbay}, year = {2025}, eprint = {2501.10604}, archivePrefix = {arXiv}, url = {https://arxiv.org/abs/2501.10604v1}, }