8月6日
01:01
01:01Qdrant@qdrant_engine
精选
FutureAGI的Rishabh与Dylan Couzon将直播演示RAG智能体的调试与优化。内容覆盖嵌入迁移、去重、重排序和评估,以衡量对检索质量的实际影响。直播时间为欧洲中部时间18:30(太平洋时间9:30)。观众可在luma.com/future-pq6q免费注册。
推荐理由:明天有个免费直播,FutureAGI的Rishabh现场调RAG智能体,讲嵌入迁移和重排序怎么影响检索效果,有时间的可以去看看。
8月3日
23:55
7月31日
23:53
23:53Qdrant@qdrant_engine
8月6日,Qdrant与FutureAGI将联合举办一场RAG-agent调试直播。活动中会现场构建并诊断一个RAG agent,定位质量下滑的环节。演示如何无停机迁移到新的embedding模型,并清理重复和碎片化的chunks。还会添加late interaction重排序,并对比每次优化前后的评估分数。

推荐理由:Qdrant和FutureAGI要直播修一个RAG agent,现场看每一步改动对效果的影响,还会演示换embedding模型和加rerank。想学RAG调优可以直接围观。
7月30日
07:09
07:09OpenRouter@OpenRouterAI
OpenRouter 发布 rerank-2.5 重排序模型,支持指令跟随能力,可提升检索准确度。定价为每百万输入 token 0.05 美元。该模型在多个检索基准上相比上一代 rerank 有显著改进。用户可通过 OpenRouter 的 API 直接调用。
推荐理由:OpenRouter 出了个新重排序模型 rerank-2.5,能听懂指令来排序,检索更准,价格还特别便宜,每百万token才5分钱。
7月1日
10:16
10:16官方账号arXiv cs.AI@Yufei Li, Zaiwei Zhang, Mingfu Liang, Kavosh Asadi, Jay Xu, Jimmy Kim, Chongyang Bai, Jieyi Zhang, Hongye Xie, Prachi Agrawal, Dian Yu, Tianyi Chen, Jean-Pascal Billaud, Garret Buell, YK, Zhu, Sachin Patil, Brooke Bian, Zhou Fang, Kevin Huang, Shiva Sudanagunta, Yuzhen Huang, Emma Lu, Chris O'Brien, Yang Song, Lihong Li, Jacob Tao, Zhicheng Zhu, Chao Li, Gaoxiang Liu, Neil Wu, Zhongyin Hu, Li Han, Loki Chen, Ming Lei, Greg Rehm, Siyuan Song, Tianwei Zhang, Li Li, Ketan Singh, Yavuz Yetim, Ilyas Atishev, Satendra Gera, Ashkan Sadeghi, Rachel Yan, Nikko Mizutani, Shuaiwen Wang, Song Yang, Zhijing Li, Jiang Liu, Mengying Sun, Fei Tian, Xiaohan Wei, Chonglin Sun, Parish Aggarwal, Kaushik Rangadurai, Zhi Hua, Frank Shyu, Ruchit Sharma, Liyuan Li, Shike Mei, Wenlin Chen, Santanu Kolay, Ben Schulte, Deepak Chandra, Adam, Song, Sandeep Pandey, Xi Liu, Hamed Firooz, Luke Simon
GR2是一个端到端的生成式推理重排序框架,面向工业推荐系统的重排序阶段。它采用语义ID分词器(唯一性≥99%)、从更强教师模型进行推理蒸馏,以及基于可验证奖励的强化学习。在工业规模流量上,GR2相比基线实现R@1提升18.7%、R@3提升7.1%、N@3提升9.6%。论文还发现奖励设计至关重要,LLM可能通过保持输入顺序或利用位置偏差来“欺骗”奖励。
推荐理由:这篇论文提出了GR2,在工业重排序上拿下了18.7%的召回提升,还解决了LLM作弊奖励的问题,做推荐系统的可以看看。
6月16日