LMCache:基于LLM服务引擎的KV缓存优化项目

LMCache: Supercharge Your LLM with the Fastest KV Cache Layer

分支88Tags99

项目介绍

将长上下文的大型语言模型推理速度提高10倍,成本降低10倍【此简介由AI生成】

定制我的领域
6411.19 K1.72 K访问 GitHub