@inproceedings{vlogvideolanguagemodelsbygenerative, title = {VLog: Video-Language Models by Generative Retrieval of Narration Vocabulary}, author = {Kevin Qinghong Lin and Mike Zheng Shou}, year = {2025}, booktitle = {CVPR 2025 1}, eprint = {2503.09402}, archivePrefix = {arXiv}, url = {https://arxiv.org/abs/2503.09402v1}, }