@article{fssuavladiscriminativeframeworkusing, title = {FSSUAVL: A Discriminative Framework using Vision Models for Federated Self-Supervised Audio and Image Understanding}, author = {Yasar Abbas Ur Rehman and Kin Wai Lau and Yuyang Xie and Ma Lan and Jiajun Shen}, year = {2025}, eprint = {2504.09516}, archivePrefix = {arXiv}, url = {https://arxiv.org/abs/2504.09516v1}, }