LLM / Agent 经验2026年9月2日·1 分钟KV Cache 为什么能加速推理?一个自注意力视角从 Transformer 自注意力公式推导 KV Cache 的保存对象与显存权衡。#LLM#推理优化#Transformer