AITP
精选全部 AI 动态AI 日报Agent 接入我的简报我的追踪阅读偏好内容方法关于更新日志信源提报反馈
外观
登录 / 注册
AITOP

Prompt Caching

共 3 条相关 AI 资讯
8月2日
03:59
03:59宝玉@dotey
精选
针对 gpt-5.6 sol max 在长任务中 auto compact 频繁突破 80% 的疑问,dotey 认为无需紧张。compact 执行过多会损害正在执行任务的上下文准确性,同时无法充分利用 Prompt Caching。目前模型长上下文处理能力已足够强,Harness 层会在 prompt 末尾补充提示,保障任务注意力。Handoff 只能缓解问题,新 session 会因补充上下文再次占满,更有效的是设置验证机制减少人工干预。
技巧gpt-5.6 sol maxcompactHandoff

推荐理由:别盯着上下文进度条了,compact没那么可怕。Handoff治标不治本,多设验证才是真省心。
原文
7月26日
12:17
12:17宝玉@dotey
精选
本文澄清了 Agent 使用 Skills 的调用流程:每个 Skill 的 name 和 description 作为系统提示词的一部分在对话开始时就加载进上下文,大模型在处理第一条消息时已知道所有 Skill 描述。实际流程中,大模型在一次调用中同步完成读取问题、对照 Skill 描述、读取 SKILL.md 指令、决定是否调用工具,并非分两次调用。Prompt Caching 机制缓存系统提示词,多轮对话中无需重新处理,节省 Token 和时间。
技巧AgentSkillsPrompt Caching

推荐理由:别再纠结Agent调用Skills是不是要调两次大模型了,这个解释一次理清流程,还讲了Prompt Caching怎么省token。
原文
6月28日
01:25
01:25宝玉@dotey
精选
Codex 和 Claude Code 的上下文压缩功能结合 Prompt Caching,使得在单个 Session 内持续对话的成本压力显著降低。用户可以通过 fork 功能从对话的某个位置创建分支,只保留之前的历史记录,使上下文更纯粹。/btw 或 /side 命令允许在不影响当前任务上下文的情况下提问,例如在 plan 模式下用 /btw 详细解释选项含义。VB 提到自 GPT 5.3 Codex 以来,他不再担心上下文问题,且 Codex 的支线线程功能非常出色。
技巧CodexClaude CodePrompt Caching

推荐理由:如果你用 Codex 或 Claude Code 做长任务,这个技巧能省下不少 token 费用,fork 和 /btw 命令特别实用。
原文
精选全部日报登录