主要来源andrew chen
查看原文事件专题 · 多源确认
Hermes Agent自动部署DeepSeek v4 Flash,双DGX Sparks单流82 tok/s
MiaAI实验室用Hermes agent根据一条X帖子,在一夜之间自动完成了DeepSeek v4 Flash GA (0731)在2块NVIDIA DGX Sparks上的部署。部署使用官方FP8权重,单流推理速度达82 tok/s,峰值约95 tok/s,三会话并发时达到135 tok/s。该方案已发布在GitHub上,并感谢了0xSero提交的PR,后续还会改进部署配方。
当前结论
Hermes agent看了条帖子就自动部署好DeepSeek v4 Flash,双DGX Sparks跑出82 tok/s,省人力还快。
11 个信源61° AI 热度最后更新 2026/8/1 16:05:59
证据链
相关来源 1IT之家
查看原文相关来源 2深度求索 DeepSeek
查看原文相关来源 3歸藏(guizang.ai)
查看原文相关来源 4Geek
查看原文相关来源 5向阳乔木
查看原文相关来源 6AI Will
查看原文相关来源 7lmarena.ai
查看原文相关来源 8elvis
查看原文相关来源 9小互
查看原文相关来源 10orange.ai
查看原文冲突核查
现有去重数据只说明这些来源讨论同一事件,不代表立场相同。当前没有结构化的支持或反驳证据,不自动推断冲突。