8月14日
11:43
11:43Aravind Srinivas@AravSrinivas
精选
Perplexity宣布将Sonar迁移至Agent API。该API在保持联网搜索的基础上,新增多步研究、代码执行、内建工具,并可通过单一接口访问多种模型。在BrowseComp和WideSearch基准上,Agent API的得分超过Sonar最佳成绩的两倍。
推荐理由:做联网搜索Agent?Perplexity Agent API支持多步研究、代码执行,基准分翻倍,值得一试。
8月6日
12:14
12:14官方账号arXiv cs.AI@Yijun Lu, Rui Ye, Jiajun Wang, Yuwen Du, Tian Jin, Songhua Liu, Siheng Chen
ABSeeker基于Qwen3.5-4B,仅用8500个示例训练,在BrowseComp上达到37.3%,在BrowseComp-ZH上达到39.1%。加入上下文管理后,成绩分别提升至55.3%和52.9%,超过同规模4B智能体,并赶上约30B参数的更大模型。其核心是ABC框架,通过答案回溯恢复线索,再将搜索每一步与线索比对,生成细粒度步骤级奖励。
推荐理由:它用答案倒推给搜索智能体每一步打分,4B模型在BrowseComp上拼到55.3%,能对标30B模型,值得看方法。