AITP
精选全部 AI 动态AI 日报Agent 接入我的简报我的追踪阅读偏好内容方法关于更新日志信源提报反馈
外观
登录 / 注册
AITOP

InfiniteBench

共 1 条相关 AI 资讯
7月22日
08:25
08:25elvis@omarsar0
精选
该研究在InfiniteBench上使用三种Agent Harness和三种模型家族(如Llama、Mistral等)测试了渐进式披露模式。对于单本书任务,增益依赖Harness:当智能体导航原始文档能力差时增益大,强Harness自带检索时增益接近零。扩展到多本书时,原始导航失败,一级披露效果领先,但二级路由层从未帮助且有时降低精度。论文表明渐进式披露主要提供上下文而非智能,在大规模语料下才体现关键作用。
论文智能体渐进式披露InfiniteBench

推荐理由:这篇论文用三个Harness和三个模型测了渐进式披露,发现小规模下效果看脸,大规模下才有用,二级路由反而坏事,值得搞智能体的人看看。
原文
精选全部日报登录