@article{perceiveanythingrecognizeexplaincaption, title = {Perceive Anything: Recognize, Explain, Caption, and Segment Anything in Images and Videos}, author = {Weifeng Lin and Xinyu Wei and Ruichuan An and Tianhe Ren and TingWei Chen and Renrui Zhang and Ziyu Guo and Wentao Zhang and Lei Zhang and Hongsheng Li}, year = {2025}, eprint = {2506.05302}, archivePrefix = {arXiv}, url = {https://arxiv.org/abs/2506.05302v1}, }