主要来源阿里通义 Qwen
查看原文事件专题 · 多源确认
LightSeek TokenSpeed实现Qwen3.8多节点低延迟推理
LightSeek的推理引擎TokenSpeed已支持Qwen3.8(2.4T参数)的大规模多节点部署。作为Day-0开源推理引擎伙伴,LightSeek针对NVIDIA Blackwell做了跨节点DP/EP扩展优化。相比TP16,TokenSpeed的吞吐性能提升超过30%。DSpark投机解码和单CUDA图优化进一步降低了延迟。
当前结论
LightSeek的TokenSpeed今天支持Qwen3.8了,多节点下比TP16快三成多,跑2.4T大模型延迟更低。
3 个信源68° AI 热度最后更新 2026/8/14 16:58:21
证据链
相关来源 1NVIDIA AI
查看原文相关来源 2IT之家
查看原文冲突核查
现有去重数据只说明这些来源讨论同一事件,不代表立场相同。当前没有结构化的支持或反驳证据,不自动推断冲突。