主要来源arXiv: Anthropic
查看原文事件专题 · 官方一手
双过程记忆架构让科学智能体突破上下文窗口限制
本文提出一种双过程记忆架构,将即时情景记忆(固定10条消息窗口)与长期知识(约3 tokens/消息增长)解耦,解决LLM在科学协作中的上下文窗口饱和问题。在15,000条消息、跨6个模型(OpenAI、Anthropic、Google)的1,440次查询评估中,该架构在10,000条消息时仍保持70-85%准确率,延迟1-2秒,且比全上下文模型节省62% tokens。研究发现双过程架构在数值/时间查询上表现优异(65-90%准确率),而RAG在历史检索上更优(60-85%),并揭示了合成测试与现实工作流之间的“模拟到现实”差距。该架构成功管理了14,000+科学事实(125k tokens),证明领域特定记忆整合可支持超长上下文持续运行。
当前结论
做科学计算或长期实验分析的AI开发者,终于有了对抗上下文饱和的实用方案——双过程架构直接省62% tokens还保持高精度,值得在长链推理任务中试试。
11 个信源63° AI 热度最后更新 2026/5/17 19:44:24
证据链
相关来源 1berryxia
查看原文相关来源 2IT之家
查看原文相关来源 3Geek
查看原文相关来源 4TestingCatalog
查看原文相关来源 5AlphaSignal
查看原文相关来源 6DeepLearning.AI
查看原文相关来源 7歸藏(guizang.ai)
查看原文相关来源 8The Rundown AI
查看原文相关来源 9Clement Delangue
查看原文相关来源 10Greg Brockman
查看原文冲突核查
现有去重数据只说明这些来源讨论同一事件,不代表立场相同。当前没有结构化的支持或反驳证据,不自动推断冲突。