[控场AI]
概念Prompt Caching

提示缓存

大语言模型API中的一项推理优化机制,通过在服务端复用多轮对话中不变前缀部分(系统提示、工具定义等)的KV Cache,避免重复计算,从而降低延迟与API调用成本

来源文章