@article{depthformermultimodalpositionalencodings, title = {DepthFormer: Multimodal Positional Encodings and Cross-Input Attention for Transformer-Based Segmentation Networks}, author = {Francesco Barbato and Giulia Rizzoli and Pietro Zanuttigh}, year = {2022}, eprint = {2211.04188}, archivePrefix = {arXiv}, url = {https://arxiv.org/abs/2211.04188v2}, }