AITP
精选全部 AI 动态AI 日报Agent 接入关于更新日志信源提报反馈
登录 / 注册
AITOP
全部 AI 动态
AI 相关资讯全量信息流
全部博客资讯推文论文
全部模型产品行业论文技巧
标签:科学智能体×
6月16日
20:46
AITOP6月16日 20:46
600亿美元买下Cursor,xAI终于拿到了编程工具,但真正值得跟踪的或许不是AI600亿美元买下Cursor,xAI终于拿到了编程工具,但真正值得跟踪的或许不是AI
6月12日
12:57
AITOP6月12日 12:57
Claude代码里藏了个20260612,18个月后的AI记忆革命已经开始倒计时
6月11日
15:28
AITOP6月11日 15:28
1107 vs 303:谷歌悄悄开源了一个“拆打字机”的模型,把大模型速度翻了4倍
15:23
AITOP6月11日 15:23
DiffusionGemma颠覆文本生成?自回归模型的“统治”要结束了
15:07
AITOP6月11日 15:07
每秒1107个token,Google开源的扩散模型为什么能改变本地推理格局?
5月19日
10:25
10:25arXiv: Anthropic@Nikola Milosevic
精选
本文提出一种双过程记忆架构,将即时情景记忆(固定10条消息窗口)与长期知识(约3 tokens/消息增长)解耦,解决LLM在科学协作中的上下文窗口饱和问题。在15,000条消息、跨6个模型(OpenAI、Anthropic、Google)的1,440次查询评估中,该架构在10,000条消息时仍保持70-85%准确率,延迟1-2秒,且比全上下文模型节省62% tokens。研究发现双过程架构在数值/时间查询上表现优异(65-90%准确率),而RAG在历史检索上更优(60-85%),并揭示了合成测试与现实工作流之间的“模拟到现实”差距。该架构成功管理了14,000+科学事实(125k tokens),证明领域特定记忆整合可支持超长上下文持续运行。
论文记忆架构科学智能体上下文窗口推理模型LLM

推荐理由:做科学计算或长期实验分析的AI开发者,终于有了对抗上下文饱和的实用方案——双过程架构直接省62% tokens还保持高精度,值得在长链推理任务中试试。
原文
精选全部日报登录