@article{weaktostrongbackdoorattacksforllmswith, title = {Weak-to-Strong Backdoor Attack for Large Language Models}, author = {Shuai Zhao and Leilei Gan and Zhongliang Guo and Xiaobao Wu and Luwei Xiao and Xiaoyu Xu and Cong-Duy Nguyen and Luu Anh Tuan}, year = {2024}, eprint = {2409.17946}, archivePrefix = {arXiv}, url = {https://arxiv.org/abs/2409.17946v3}, }