@article{improvedknowledgedistillationforpre, title = {Improved Knowledge Distillation for Pre-trained Language Models via Knowledge Selection}, author = {Chenglong Wang and Yi Lu and Yongyu Mu and Yimin Hu and Tong Xiao and Jingbo Zhu}, year = {2023}, eprint = {2302.00444}, archivePrefix = {arXiv}, url = {https://arxiv.org/abs/2302.00444v1}, }