@inproceedings{visionllmlargelanguagemodelisalsoan, title = {VisionLLM: Large Language Model is also an Open-Ended Decoder for Vision-Centric Tasks}, author = {Wenhai Wang and Zhe Chen and Xiaokang Chen and Jiannan Wu and Xizhou Zhu and Gang Zeng and Ping Luo and Tong Lu and Jie zhou and Yu Qiao and Jifeng Dai}, year = {2023}, booktitle = {NeurIPS 2023 11}, eprint = {2305.11175}, archivePrefix = {arXiv}, url = {https://arxiv.org/abs/2305.11175v2}, }