做长任务 Agent 的朋友看看这篇:TRACE 用 590 个真实压缩边界回放数据测了压缩时机怎么选,结论是历史行为预测力很弱,数据和方法都开源了。
#上下文压缩
共 21 条 · 7 天 3 条 · 30 天 6 条
信息流里打上「上下文压缩」标签的资讯、产品与论文,按刊登时间排,新的在上。
10月7日
新研究:用 Agent 历史预测上下文压缩何时造成损害
10月6日
10月5日
10月2日
9月29日
9月20日
9月6日
9月2日
8月18日
论文10:27
上下文压缩的隐性代价:智能体交互成本测量这篇论文用GPT-5.5和DeepSeek实测发现,压缩上下文会让智能体反复重新查工具,任务成功率却没变。想知道为什么只看完成率会骗人,可以读读。
8月15日
8月4日
8月2日
dotey:Codex 连续任务省 token,handoff 新会话已不如 /compact
dotey 用实际经验讲清 handoff 和 /compact 怎么选,还给了防偷懒的验收标准,适合用 Codex 做连续任务的。
7月31日
7月30日
7月23日
6月28日
Codex/Claude Code 上下文压缩加 Prompt Caching 降低连续会话成本
如果你用 Codex 或 Claude Code 做长任务,这个技巧能省下不少 token 费用,fork 和 /btw 命令特别实用。
6月11日
6月9日
5月19日
Elastic-dLLM:位置保持的扩散LLM上下文压缩与增强
扩散LLM的并行解码效率一直是痛点,这篇工作直接戳中计算冗余的核心,做模型推理加速或长上下文应用的开发者值得关注,压缩方法可以直接集成到现有dLLM中。
5月14日
腾讯开源 TencentDB Agent Memory,长任务 Token 消耗降低 61%
做 Agent 长任务开发的团队终于有了省 Token 又保精度的开源方案——上下文卸载加任务画布让 Token 消耗降 61% 的同时成功率还上升,建议直接集成试试。