#检索增强生成
想给RAG省算力又不想掉精度?CoinRAG把检索结果拆成小碎块做缓存复用,LongBench上F1平均提了5.3%,值得一看。
想搭多模态RAG?这个Colab教程带你用RAG-Anything处理文本、表格、方程和图像,还支持四种检索模式,上手超快。
做复杂推理的AI研究者终于有了一个不依赖语义相似度的检索框架——RA-RFT让模型学会类比推理,数学基准提升显著,做RAG或强化微调的团队值得关注。
内容审核系统常忽视文化隐性歧视,Mod-Guide通过RAG融入少数群体视角,做AI伦理或内容审核的团队值得关注其方法论。
SARDI巧妙利用了扩散模型去噪过程中的“废料”token,为RAG提供了一种零成本的前瞻信号,做问答系统或检索增强生成的团队值得关注,可以直接集成到现有扩散模型中提升效果。
智能体开发者都在头疼检索问题——什么时候搜、搜什么、够不够用?这场 Meetup 把 cognee、deepset、LlamaIndex 和 n8n 的构建者聚在一起,直接回答你的疑问。做 RAG 或智能体系统的建议报名,现场还能和 Qdrant CTO 交流。
做新闻聚合或信息检索的开发者,这篇论文戳破了AI聊天机器人的“可靠”假象——高准确率不等于可信赖,自由回答和跨语言场景下漏洞明显,值得点开看看你的系统是否也踩了同样的坑。
金融量化团队终于有了一个不折腾大模型、只优化检索来源就能显著提升收益风险比的方案——Sharpe从0.52到0.84的跃升很实在,做事件驱动策略的可以直接参考这个贝叶斯记忆模块。
Claude Opus 4.8 让编码智能体更自主,但检索质量成为瓶颈——做智能体开发或 RAG 的团队,建议关注 Milvus 如何解决上下文精准问题。
做数据科学或材料信息学的团队终于有了一个无需统一变量名就能对齐异构表格数据的方法,检索准确率高达0.9还支持隐私保护,做RAG或算法选择的开发者可以直接参考。
做 RAG 或搜索系统的开发者,这个教程直接教你用 Zerank-2 搭建两阶段管道,从环境配置到实战代码都有,值得跟着跑一遍。
做 RAG 系统的团队终于有了解决检索错配的实用方案——CRAG 在检索后加一道评估关卡,直接过滤掉相似但不相关的文档。做知识库问答或搜索增强应用的开发者,值得看看这个改进管道的方法。