@article{videobenchacomprehensivebenchmarkand, title = {Video-Bench: A Comprehensive Benchmark and Toolkit for Evaluating Video-based Large Language Models}, author = {Munan Ning and Bin Zhu and Yujia Xie and Bin Lin and Jiaxi Cui and Lu Yuan and Dongdong Chen and Li Yuan}, year = {2023}, eprint = {2311.16103}, archivePrefix = {arXiv}, url = {https://arxiv.org/abs/2311.16103v2}, }