主要来源IT之家
查看原文事件专题 ·多源确认
字节团队发现DeepSeek长上下文性能漂移原因
字节Seed团队在arXiv发表论文指出,DeepSeek-V4系列模型因分块KV缓存压缩存在相位敏感性。相同信息在不同压缩窗口边界位置检索难度差异显著,长上下文检索准确度在各阶段间可能相差40个百分点。研究评估了DeepSeek-V4-Flash、DeepSeek-V4-Pro和DeepSeek-V4.1-Flash模型。
当前结论
字节团队找到了DeepSeek'抽风'的真正原因,长上下文性能居然会周期性波动40%。
4 个信源67° AI 热度最后更新 2026/10/9 00:49:58
证据链
4 个信源冲突核查
现有去重数据只说明这些来源讨论同一事件,不代表立场相同。当前没有结构化的支持或反驳证据,不自动推断冲突。