09:21官方一手arXiv: DeepSeek@Qunhui Zhang论文提出VirtualSet,一种接收者类型化的本体世界接口,替代SQL作为LLM的生成目标。在BIRD基准测试的1072题子集上,VirtualSet配合deepseek-reasoner达到67.5%准确率,比带修复和投票的SQL高4.0个百分点(p=0.00117)。系统通过通用约束投影(GCP)在表达式执行前检查,并利用集合链保留具体接收者类型将无效字段转为类型错误。在30个受控决策用例中,写入链拦截了20/20的幻觉动作体且无假阳性。论文VirtualSetBIRDdeepseek-reasoner推荐理由:用VirtualSet替代SQL,让LLM查询出错时提前报类型错误而不是给假结果,BIRD上还比SQL高4个点,很适合做安全决策。原文稍后读已读值得跟进有用关注 VirtualSet
01:48Weaviate@weaviate_ioWeaviate发布了Query Agent,支持在Playground中用自然语言进行欺诈检测数据探索。用户可提问如“哪些客户的交易有地址不匹配”,Agent自动生成跨Transactions、Customers、PhoneProducts三个集合的查询。它同时应用过滤、聚合和跨集合查找,实时返回结果并可查看底层查询。该工具能识别如可疑支付方式、地址不匹配等欺诈模式。AI产品WeaviateQuery Agent欺诈检测推荐理由:Weaviate出了个Query Agent,你直接问问题就能查数据库,不用写SQL,感觉比传统规则系统灵活多了。原文稍后读已读值得跟进有用关注 Weaviate