Qdrant 给 LangGraph 做了个记忆存储集成,让智能体跨会话记住上下文,靠语义检索而不是关键词匹配,做 Agent 的开发者可以试试。
#向量数据库
Milvus 3.0 把向量库升级成支持全文、JSON 和标量的混合检索引擎,10 月 21 日旧金山现场还有 6sense 的大规模实体解析实战分享。
Weaviate 上线了查询剖析功能,能告诉你慢在 HNSW、过滤还是磁盘读取,示例里 48.2ms 有 36.8ms 花在对象回取,调优前先看这个。
Pinecone 官方分享的实战教程,教你把 Pinecone 当向量搜索、Postgres 当数据源,两者同步怎么做都写清楚了,附完整代码仓库。
Toyota 把几十年制造知识接入 AI,但数据不能出内网,靠 Pinecone BYOC 解决。做企业 RAG 的可以看看这种部署模式。
Kaivid Labs 把 40 万向量从 Milvus 搬到 Qdrant 的全过程都写出来了,还带了延迟和内存对比,要做向量库选型的可以看看。
Zilliz 推出的 Milvus 3.0 升级指南很实用,详细说明了新版本的新特性和如何安全升级,对想使用 Milvus 3.0 的开发者很有帮助。
Weaviate给Query Agent加了filtering参数,想要更多结果选recall,要精准匹配就选precision,适合做RAG的人调一调。
Qdrant 新版 1.19 要来了,8月20日有官方答疑,想第一时间了解向量数据库新功能就去 Discord 听,还能直接问问题。
Milvus 3.0 带快照和 Spark 连接器,不用复制数据就能给 AI 数据做稳定视图,还能跑分布式批量处理,把结果写回去。
Milvus 3.0 的 Loon 存储引擎把对象存储上的点读取量降到原来的六分之一,做向量检索时不用再读一堆无关数据了。
Milvus 3.0 新出的 External Collections,让你直接搜对象存储里的向量数据,不用再拷贝一份。省掉同步和权限麻烦,快试试。
Weaviate向量数据库现在可以直接在DigitalOcean上用托管版,不用自己搭服务器,自动备份和高可用都帮你搞定了,省心。
Qdrant刚发了博客回应Elastic的测试,发现对方没开它的优化功能,一开就反超了:吞吐量翻倍,延迟减半,计算资源只要三分之一。想选向量数据库的可以看看。