Aiwei Liu, Haoping Bai, Zhiyun Lu, Xiang Kong, Simon Wang, Jiulong Shan, Meng Cao, Lijie Wen: Direct Large Language Model Alignment Through Self-Rewarding Contrastive Prompt Distillation. ACL (1) 2024: 9688-9712