事件专题 · 多源确认

Hermes Agent自动部署DeepSeek v4 Flash,双DGX Sparks单流82 tok/s

MiaAI实验室用Hermes agent根据一条X帖子,在一夜之间自动完成了DeepSeek v4 Flash GA (0731)在2块NVIDIA DGX Sparks上的部署。部署使用官方FP8权重,单流推理速度达82 tok/s,峰值约95 tok/s,三会话并发时达到135 tok/s。该方案已发布在GitHub上,并感谢了0xSero提交的PR,后续还会改进部署配方。

当前结论

Hermes agent看了条帖子就自动部署好DeepSeek v4 Flash,双DGX Sparks跑出82 tok/s,省人力还快。

11 个信源61° AI 热度最后更新 2026/8/1 16:05:59

证据链

相关来源 2深度求索 DeepSeek
查看原文
相关来源 3歸藏(guizang.ai)
查看原文

冲突核查

现有去重数据只说明这些来源讨论同一事件,不代表立场相同。当前没有结构化的支持或反驳证据,不自动推断冲突。

查看资讯详情