主要来源Geek
查看原文事件专题 · 多源确认
DeepSeek V4 Flash 家用部署实测:单机峰值 1875 tok/s
Alec Fong 在单台 GB300 DGX Station 上部署 DeepSeek V4 Flash,测得聚合峰值吞吐 1875 tok/s,单流 300 tok/s,128k 上下文下首 token 延迟 5 秒。推文感叹能在家部署该模型的人相当于 80 年代万元户,令人羡慕。
当前结论
有人晒了 DeepSeek V4 Flash 在 DGX Station 上的实测数据,单机每秒能跑 1875 个 token,128k 上下文首字只要 5 秒,你可以拿这个数去衡量本地部署值不值。
9 个信源53° AI 热度最后更新 2026/8/7 07:12:03
证据链
相关来源 1NVIDIA AI
查看原文相关来源 2pandaily
查看原文相关来源 3IT之家
查看原文相关来源 4AI Will
查看原文相关来源 5Decoder
查看原文相关来源 6arXiv: DeepSeek
查看原文相关来源 7ollama
查看原文相关来源 8歸藏(guizang.ai)
查看原文冲突核查
现有去重数据只说明这些来源讨论同一事件,不代表立场相同。当前没有结构化的支持或反驳证据,不自动推断冲突。