@article{lmcacheanefficientkvcachelayerforenterpr, title = {LMCache: An Efficient KV Cache Layer for Enterprise-Scale LLM Inference}, author = {Yuhan Liu and Yihua Cheng and Jiayi Yao and Yuwei An and Xiaokun Chen and Shaoting Feng and Yuyang Huang and Samuel Shen and Rui Zhang and Kuntai Du and Junchen Jiang}, year = {2025}, eprint = {2510.09665}, archivePrefix = {arXiv}, url = {https://arxiv.org/abs/2510.09665}, }