#RAG
共 313 条 · 7 天 49 条 · 30 天 121 条
8月19日
8月18日
8月17日
8月15日
Qdrant与Minima在单张RTX PRO 6000 Blackwell GPU上跑agentic RAG
Qdrant和Minima搞了个agentic RAG,单张RTX PRO 6000就够,首次检索命中率从72%提到87%,延迟从21秒降到7.7秒,效率提升快三倍。
8月14日
8月13日
8月12日
8月11日
Weaviate Search Mode新增effort参数,控制测试时计算成本
Weaviate给搜索模式加了effort档位,想省算力就选medium,要质量就上ultrahigh,BRIGHT基准上提升明显,做RAG的可以试试。
论文10:40
SodaMem:为LLM智能体打造的证据型时间图记忆做长期记忆的智能体开发者可以看看,SodaMem用图结构加证据链,在LongMemEval-S上准确率92.8%,成本还低,比普通RAG日记靠谱。
产品06:04
Voyage AI 模型原生登录 Fireworks,系 MongoDB 合作的首个专用推理平台Voyage AI的embedding和rerank模型现在Fireworks直接能跑,还能和你的开源模型放一起,检索全流程一个平台搞定。
8月10日
论文11:03
CoinRAG:面向长上下文RAG的上下文信息碎块KV缓存复用想给RAG省算力又不想掉精度?CoinRAG把检索结果拆成小碎块做缓存复用,LongBench上F1平均提了5.3%,值得一看。
8月8日
AI Agent答错时,先别怪模型,问题可能出在检索层
Milvus 团队分享:Agent 答错先查检索层,用 EXPLAIN 思路可视化向量搜索,讲 IVF/HNSW/DiskANN 取舍,搞 RAG 的值得看。
8月7日
8月6日
模型11:47
MultiPathFormer:以多径传播为预训练目标的无线基础模型想做无线信道估计或波束预测的可以看看,它用路径预测代替传统掩码重建,环境RAG让延迟估计直接涨59%,效果比现有模型好。
8月5日
Amazon Bedrock正式推出Web Search功能,增强模型接地能力
AWS把联网搜索直接做进了Bedrock,不用再接第三方API,用OpenAI Responses API就能启用,做RAG的可以看看。
8月4日
8月3日