@article{vulnerabilitymitigationforsafetyaligned, title = {Vulnerability Mitigation for Safety-Aligned Language Models via Debiasing}, author = {Thien Q. Tran and Akifumi Wachi and Rei Sato and Takumi Tanabe and Youhei Akimoto}, year = {2025}, eprint = {2502.02153}, archivePrefix = {arXiv}, url = {https://arxiv.org/abs/2502.02153v1}, }