主要来源Blognone
查看原文事件专题 ·多源确认
DeepSeek 发布 V4.1 Flash 模型,性能对标 GLM-5.3,KV 缓存技术大幅降低内存占用
DeepSeek 推出 V4.1 Flash 模型,其性能在测试中超过 V4 Pro,达到与 GLM-5.3、Kimi K3 相当的水平。该模型通过 CSA2 架构和 FP4 KV 缓存技术,将每 token 的缓存内存从 4KB 降低至 890 字节,内存占用减少 4 倍,使推理成本大幅下降。
当前结论
DeepSeek 新出的 V4.1 Flash 模型,性能不错,和 GLM-5.3 差不多,关键是内存消耗特别低,适合做 agentic 任务,价格也便宜很多。
5 个信源58° AI 热度最后更新 2026/9/10 15:30:28
证据链
5 个信源冲突核查
现有去重数据只说明这些来源讨论同一事件,不代表立场相同。当前没有结构化的支持或反驳证据,不自动推断冲突。