@article{constrainededgeaideploymentfinetuningvs, title = {Constrained Edge AI Deployment: Fine-Tuning vs Distillation for LLM Compression}, author = {Jacob Sander and David Moe and Achraf Cohen and Brent Venable and Venkat Dasari and Brian Jalaian}, year = {2025}, eprint = {2505.18166}, archivePrefix = {arXiv}, url = {https://arxiv.org/abs/2505.18166v1}, }