@inproceedings{211114821v2, title = {End-to-End Referring Video Object Segmentation with Multimodal Transformers}, author = {Adam Botach and Evgenii Zheltonozhskii and Chaim Baskin}, year = {2021}, booktitle = {CVPR 2022 1}, eprint = {2111.14821}, archivePrefix = {arXiv}, url = {https://arxiv.org/abs/2111.14821v2}, }