事件专题 ·多源确认

DeepSeek 发布 V4.1 Flash 模型,性能对标 GLM-5.3,KV 缓存技术大幅降低内存占用

DeepSeek 推出 V4.1 Flash 模型,其性能在测试中超过 V4 Pro,达到与 GLM-5.3、Kimi K3 相当的水平。该模型通过 CSA2 架构和 FP4 KV 缓存技术,将每 token 的缓存内存从 4KB 降低至 890 字节,内存占用减少 4 倍,使推理成本大幅下降。

当前结论

DeepSeek 新出的 V4.1 Flash 模型,性能不错,和 GLM-5.3 差不多,关键是内存消耗特别低,适合做 agentic 任务,价格也便宜很多。

5 个信源58° AI 热度最后更新 2026/9/10 15:30:28

证据链

5 个信源

冲突核查

现有去重数据只说明这些来源讨论同一事件,不代表立场相同。当前没有结构化的支持或反驳证据,不自动推断冲突。