做长任务 Agent 的朋友看看这篇:TRACE 用 590 个真实压缩边界回放数据测了压缩时机怎么选,结论是历史行为预测力很弱,数据和方法都开源了。
#TRACE
共 14 条 · 7 天 1 条 · 30 天 4 条
信息流里打上「TRACE」标签的资讯、产品与论文,按刊登时间排,新的在上。
10月7日
新研究:用 Agent 历史预测上下文压缩何时造成损害
10月2日
9月29日
9月25日
9月10日
9月3日
8月3日
7月16日
论文11:20
TRACE:通过信用估计实现长程智能体回合级奖励分配想解决Agent长程任务奖励稀疏问题?看TRACE方法,无需额外批评器,用TD变化给每步打分,Qwen3在BrowseComp-Plus上从7分直接跳到35分。
7月13日
7月10日
TRACE:智能体识别缺失能力自我改进,Qwen3.6-27B达73.2%
斯坦福AI Lab搞了个新方法TRACE,让AI自己找短板补课。只用四分之一训练量就超过了GRPO和GEPA,还赢了大模型Codex 5.2和GLM 5。
6月30日
论文11:19
TRACE:对齐RANO 2.0的可解释纵向胶质母细胞瘤MRI评估模型想理解脑肿瘤MRI评估的黑箱?TRACE用概念瓶颈让模型决策透明可验证,在LUMIERE上表现接近非可解释方法,值得看。
6月15日
5月19日