@article{orbenchanoverrefusalbenchmarkforlarge, title = {OR-Bench: An Over-Refusal Benchmark for Large Language Models}, author = {Justin Cui and Wei-Lin Chiang and Ion Stoica and Cho-Jui Hsieh}, year = {2024}, eprint = {2405.20947}, archivePrefix = {arXiv}, url = {https://arxiv.org/abs/2405.20947v3}, }