@article{directlargelanguagemodelalignmentthrough, title = {Direct Large Language Model Alignment Through Self-Rewarding Contrastive Prompt Distillation}, author = {Aiwei Liu and Haoping Bai and Zhiyun Lu and Xiang Kong and Simon Wang and Jiulong Shan and Meng Cao and Lijie Wen}, year = {2024}, eprint = {2402.11907}, archivePrefix = {arXiv}, url = {https://arxiv.org/abs/2402.11907v2}, }