论文11:46评估框架 ContinualSkillBench 检验 LLM 智能体的技能进化能力这篇论文给了一套测试方法,来验证 LLM 智能体到底会不会把经验变成可复用的技能,而不是光靠记住上下文。#ContinualSkillBench#智能体#持续学习#上下文学习aarXiv cs.LG@Tianyi Guan 等 8 人原文稍后读已读值得跟进有用关注 ContinualSkillBench