17:41官方账号Together AI@togethercompute72°rox_ai构建了自主搜索代理,在生产环境运行超过6个月。该代理达到了91.3%的准确率,每次查询成本仅为1.03美分。Together AI为其提供了推理算力支持。这展示了强推理经济学带来的效率提升。AI产品rox_aiTogether AI搜索代理推荐理由:rox_ai用Together AI做的搜索代理,准确率91.3%,每次才1分钱,效率真高!原文稍后读已读值得跟进有用关注 rox_ai
16:10官方账号Decoder@Jonathan Kemper新基准DiscoBench指出,AI搜索代理在多步研究中的真正短板不是搜索能力,而是当查询模糊时不会向用户追问澄清。测试显示,反复搜索但不追问的模型准确率仅51.9%,甚至低于直接猜测。表现最好的模型整体准确率也仅为43%。当移除查询中的歧义后,模型准确率最高可提升40个百分点。AI模型DiscoBench搜索代理模糊查询推荐理由:DiscoBench告诉你,AI搜索代理的问题不是搜不到,而是不敢问——模糊查询时卡住比瞎猜还差。原文稍后读已读值得跟进有用关注 DiscoBench
19:11官方账号arXiv cs.AI@Tz-Huan Hsu, Jheng-Hong Yang, Jimmy Lin本研究探讨了在构建深度研究系统时,是否仅需词汇检索器BM25配合更强的大型语言模型即可实现高效结果。研究者提出了Pi-Serini搜索智能体,它具备检索、浏览和阅读文档三个工具。在测试集B-Plus上,Pi-Serini搭配gpt-5.5达到了83.1%的答案准确率和94.7%的证据召回率,超过了使用稠密检索的代理。通过调整BM25参数和增加检索深度,答案准确率提升了18.0%,证据召回率提升了11.1%和25.3%。这表明在推理能力更强的LLM辅助下,传统词汇检索仍能发挥重要作用。代码已开源。论文搜索代理检索增强BM25推荐理由:该研究挑战了稠密检索在深度搜索中不可或缺的假设,为构建轻量、高效、不依赖外挂向量库的搜索代理提供了新思路,值得关注推理模型与经典检索技术的结合。原文稍后读已读值得跟进有用关注 搜索代理