02:52elvis@omarsar0精选斯坦福大学提出AutoMem框架,将智能体记忆管理从固定模块转变为可训练技能。模型自主决定编码、检索与笔记组织,文件系统操作作为一等动作。AutoMem通过两循环自动化:强LLM重写记忆结构,智能体历史记忆决策作为训练信号。仅优化记忆使基础智能体在Crafter、MiniHack、NetHack上提升2-4倍。32B开源模型因此与Claude Opus 4.5、Gemini 3.1 Pro Thinking性能相当。AI模型AutoMemStanfordCrafterMiniHack智能体记忆1 个信源在谈推荐理由:斯坦福发了个AutoMem,给智能体装上可训练的记忆模块,让32B模型打平Claude Opus 4.5。省去调任务动作,光改记忆就提升2-4倍,搞长程任务的别错过。原文
AITOP5月29日 08:02Opus 4.8发布:编程助手的“静默时刻”,是解放开发者,还是新门槛?🔥Anthropic 把 AI 编程的“确认键”彻底删掉了!Claude Code 搭载全新 Opus 4.8 模型,长时间任务不跑偏、不废话、不中断,像一个资深工程师一样默默干活,从功能开发到漏洞清扫全包圆,你在旁边喝茶等结果就行。过去 AI 写代码三步一问“这样可以吗”,现在它直接交完整交付物……自主编程的最后一层窗户纸,被捅破了。做自动化开发和代码审查的团队,这个模型建议直接上手,效率差距肉眼可见……