09:26官方账号arXiv cs.AI@Xichen Zhang, Yingjie Zhang, Tianshu Sun该论文提出一个名为"层归因"的框架,将AI智能体行为分析分为基础计算层(架构、记忆、感知、注意力、表征)和行为调节层(身份、资源、目标、社会互动、制度约束、治理)。框架指出三个关键结论:替代有效性是模型-任务-层的关系,人机差异提供诊断证据,治理需在干预前进行源头归因。该框架为评估AI智能体行为来源提供了系统性方法。论文AI Agent层归因智能体推荐理由:这篇论文把AI行为拆成两层来诊断,教你看清行为是来自模型结构还是外部规则,对搞智能体评估和治理的人很有用。原文稍后读已读值得跟进有用关注 AI Agent
09:38官方账号arXiv cs.AI@Zhengyi Zhuo, Yan Liu精选论文提出Ada框架,通过有限工具接口让AI Agent在真实代码库中自由探索,记录其导航、证据选择、综合理解等行为轨迹。研究分析了408条轨迹,覆盖多种模型和仓库,将工具使用数据转化为可比较的行为画像。该方法揭示了不同Agent在效率、轨迹多样性、认知基础等方面的差异,为观察SWE Agent在真实环境中的行为提供了方法论基础。论文SWE Agent代码理解行为分析推荐理由:研究SWE Agent行为的团队终于有了可量化的观察方法——Ada框架把黑箱行为变成可比较的轨迹画像,做Agent评估和调试的开发者值得关注。原文稍后读已读值得跟进有用关注 SWE Agent