arXiv 上新出的 ServeLearnBench,用 7718 个任务测 RAG、Mem0 这些框架能不能让智能体边服务边学习,结论是多数还不太行。
#Mem0
Mem0 团队做了个新基准 DolphinBench,专测智能体记忆:不看答题对错,看长对话后动作做没做对,还把成本和延迟一起排名,选记忆系统前可以先看看。
Mem0 推出了 Eve Memory Agent 模板,用 Claude 3.5 模型,在 Vercel 上就能快速部署,帮你快速实现智能体记忆功能。
朋友,Mem0 在 Vercel Marketplace 上线了,能帮你给 AI 代理加个记忆功能,让对话更连贯,和之前只能单次对话的代理不一样。
NVIDIA新嵌入模型Nemotron-3-Embed在检索任务上超越Qwen-3-600m,开放权重加NVFP4,适合做记忆系统。
Mem0 出了个 openmemory v2,开源 CLI,能让你在 Claude、Codex 和 OpenCode 之间搬编码聊天记录,想尝鲜 GPT-5.6 又不想丢进度?用它就行。
做智能体开发的团队值得关注——Mem0 的 CEO 将揭示记忆如何成为智能体持续学习的关键,这直接关系到智能体长期记忆和上下文管理的实现路径。
AI 研究者与构建者难得有机会线下面对面交流,Mem0 组织的这场扑克之夜能让你在轻松氛围中结识同行,建议在 AI 领域深耕的从业者关注并报名。
做 Agent 开发的团队终于有机会深入记忆和工具链这些实际痛点,Pune 及周边的开发者可以直接去现场动手学,别错过。
这是首个纯 AI 智能体间的记忆竞赛,做智能体开发或研究记忆机制的团队值得关注——它直接测试智能体在无人类干预下的协作与记忆价值判断能力,结果数据集可能成为未来智能体记忆研究的基准。
做 AI 智能体自动化的团队终于不用在凭证配置上卡壳了——Agent-First 让智能体自主调用外部 API 和工具时不再需要人类介入,建议做智能体编排的开发者直接试试。