全部 AI 动态 · AI 热点

6月16日

20:46

AITOP6月16日 20:46

600亿美元买下Cursor，xAI终于拿到了编程工具，但真正值得跟踪的或许不是AI

600亿美元买下Cursor，xAI终于拿到了编程工具，但真正值得跟踪的或许不是AI

6月12日

12:57

AITOP6月12日 12:57

Claude代码里藏了个20260612，18个月后的AI记忆革命已经开始倒计时

6月11日

23:56

23:56

Milvus@milvusio

LEMUR 是一种将多向量压缩为单向量的策略，声称无需调参、数据驱动。但研究发现，在文档长度差异大的语料（如 LoTTE，长度范围 400 倍）上，LEMUR 会学习到“长文档得分更高”的偏差，导致按长度而非相关性排序。在 LoTTE 上，LEMUR 的 nDCG@10 仅 0.109，召回率 30.5%，而 Exact MaxSim 方法达 0.722 和 98%。问题根源在于 LEMUR 的训练标签（MaxSim 分数）天然偏向长文档，MLP 学到了长度信号。建议用户检查语料的长度分布（P90/P10 比）和模型的可分离性（MaxSim 标准差），若长度差异大或可分离性高，应改用 TokenANN 或 MUVERA。已使用 LEMUR 的团队可通过长度分层采样缓解偏差。

论文向量检索多向量压缩长度偏差 LEMUR Milvus

推荐理由：做向量检索的团队注意了——LEMUR 在长尾语料上会悄悄按文档长度排序而非相关性，LoTTE 上召回率从 98% 掉到 30.5%。如果你的语料长度差异大（P90/P10 > 20），建议先跑文中的两个检查再决定是否用 LEMUR。

15:28

AITOP6月11日 15:28

1107 vs 303：谷歌悄悄开源了一个“拆打字机”的模型，把大模型速度翻了4倍

15:23

AITOP6月11日 15:23

DiffusionGemma颠覆文本生成？自回归模型的“统治”要结束了

15:07

AITOP6月11日 15:07

每秒1107个token，Google开源的扩散模型为什么能改变本地推理格局？