模型12:17FreqDepthKV:频率引导深度共享实现长上下文LLM高效KV缓存压缩FreqDepthKV在长上下文推理中将KV缓存压缩3.9倍,同时保持任务精度,比此前压缩方法更稳定,适合内存受限场景。#FreqDepthKV#KV缓存压缩#长上下文#LLM推理aarXiv cs.AI@Anna Córdoba 等 7 人原文稍后读已读值得跟进有用关注 FreqDepthKV