事件专题 ·多源确认

字节团队发现DeepSeek长上下文性能漂移原因

字节Seed团队在arXiv发表论文指出,DeepSeek-V4系列模型因分块KV缓存压缩存在相位敏感性。相同信息在不同压缩窗口边界位置检索难度差异显著,长上下文检索准确度在各阶段间可能相差40个百分点。研究评估了DeepSeek-V4-Flash、DeepSeek-V4-Pro和DeepSeek-V4.1-Flash模型。

当前结论

字节团队找到了DeepSeek'抽风'的真正原因,长上下文性能居然会周期性波动40%。

4 个信源67° AI 热度最后更新 2026/10/9 00:49:58

证据链

4 个信源

冲突核查

现有去重数据只说明这些来源讨论同一事件,不代表立场相同。当前没有结构化的支持或反驳证据,不自动推断冲突。