@article{leveragingvisionlanguagemodelsforopen, title = {Leveraging Vision-Language Models for Open-Vocabulary Instance Segmentation and Tracking}, author = {Bastian Pätzold and Jan Nogga and Sven Behnke}, year = {2025}, eprint = {2503.16538}, archivePrefix = {arXiv}, url = {https://arxiv.org/abs/2503.16538v1}, }