@article{framefusioncombiningsimilarityand, title = {FrameFusion: Combining Similarity and Importance for Video Token Reduction on Large Visual Language Models}, author = {Tianyu Fu and Tengxuan Liu and Qinghao Han and Guohao Dai and Shengen Yan and Huazhong Yang and Xuefei Ning and Yu Wang}, year = {2024}, eprint = {2501.01986}, archivePrefix = {arXiv}, url = {https://arxiv.org/abs/2501.01986v1}, }