@article{inferencetimetexttovideoalignmentwith, title = {Inference-Time Text-to-Video Alignment with Diffusion Latent Beam Search}, author = {Yuta Oshima and Masahiro Suzuki and Yutaka Matsuo and Hiroki Furuta}, year = {2025}, eprint = {2501.19252}, archivePrefix = {arXiv}, url = {https://arxiv.org/abs/2501.19252v1}, }