8月21日
21:38
21:38官方账号NVIDIA AI@NVIDIAAI
精选
NVIDIA AVO通过持续检查、规划、实施和评估,利用内存、工具和执行反馈来构建学习成果,实现长任务中的持续进步。阅读关于AVO及其为长周期自主智能体构建的过程:nvda.ws/3S5qdS1
事件专题

推荐理由:NVIDIA的AVO系统持续优化,适合长周期自主智能体,与现有模型相比,进步更持续。
6月2日
11:12
11:12官方账号arXiv cs.AI@Xinyu Che, Junqi Xiong, Yunfei Ge, Xinping Lei, Shihao Li, Hang Yan, Han Li, Yuanxing Zhang, Zhiqi Bai, Jinhua Hao, Ming Sun, Han Li, Jiaheng Liu
网络上有大量多模态、异构、嘈杂的程序性知识,但直接用于智能体执行长周期任务效果不佳。研究者提出 guide-to-skill 学习问题,并发布首个基准 MMG2Skill-Bench。他们设计的闭环框架 MMG2Skill 能将人类指南编译为可编辑技能,在执行时条件化固定视觉语言模型,并通过轨迹级根因反馈持续修正技能。在 GUI 控制、开放游戏和策略卡牌等六个 VLM 骨干上,该方法比基线提升 12.8 到 25.3 个百分点。消融实验表明,直接提示原始指南反而会降低性能,而结构化技能构建和轨迹驱动修正是关键。
推荐理由:做智能体长任务规划的团队终于有了把网络教程变成可执行技能的方案——MMG2Skill 直接解决了指南与技能之间的鸿沟,做 GUI 自动化或游戏 AI 的开发者可以试试这个闭环框架。
5月28日
05:08
05:08官方账号LangChain@LangChainAI
LangChain 发布了 Managed Deep Agents,专为需要长时间运行、使用工具、保持上下文并生成产物的智能体设计。该产品支持多种应用场景,包括客服与分类智能体、研究智能体、编程智能体、数据分析智能体和内部运营智能体。它解决了传统智能体在长周期任务中上下文丢失和工具调用不稳定的问题。团队可以基于此构建更可靠、更自主的自动化工作流。
推荐理由:做复杂自动化任务的团队终于有了专门的长周期智能体方案——LangChain 的 Managed Deep Agents 解决了上下文丢失和工具调用稳定性问题,做客服、研究、编程或数据分析的开发者可以直接用来构建更可靠的自主工作流。