@article{vjepa2selfsupervisedvideomodelsenable, title = {V-JEPA 2: Self-Supervised Video Models Enable Understanding, Prediction and Planning}, author = {Mido Assran and Adrien Bardes and David Fan and Quentin Garrido and Russell Howes and Mojtaba and Komeili and Matthew Muckley and Ammar Rizvi and Claire Roberts and Koustuv Sinha and Artem Zholus and Sergio Arnaud and Abha Gejji and Ada Martin and Francois Robert Hogan and Daniel Dugas and Piotr Bojanowski and Vasil Khalidov and Patrick Labatut and Francisco Massa and Marc Szafraniec and Kapil Krishnakumar and Yong Li and Xiaodong Ma and Sarath Chandar and Franziska Meier and Yann Lecun and Michael Rabbat and Nicolas Ballas}, year = {2025}, eprint = {2506.09985}, archivePrefix = {arXiv}, url = {https://arxiv.org/abs/2506.09985v1}, }