@article{trailblazerhistoryguidedreinforcementlea, title = {TrailBlazer: History-Guided Reinforcement Learning for Black-Box LLM Jailbreaking}, author = {Sung-Hoon Yoon and Ruizhi Qian and Minda Zhao and Weiyue Li and Mengyu Wang}, year = {2026}, eprint = {2602.06440}, archivePrefix = {arXiv}, url = {https://arxiv.org/abs/2602.06440}, }