事件专题 · 多源确认

LightSeek TokenSpeed实现Qwen3.8多节点低延迟推理

LightSeek的推理引擎TokenSpeed已支持Qwen3.8(2.4T参数)的大规模多节点部署。作为Day-0开源推理引擎伙伴,LightSeek针对NVIDIA Blackwell做了跨节点DP/EP扩展优化。相比TP16,TokenSpeed的吞吐性能提升超过30%。DSpark投机解码和单CUDA图优化进一步降低了延迟。

当前结论

LightSeek的TokenSpeed今天支持Qwen3.8了,多节点下比TP16快三成多,跑2.4T大模型延迟更低。

3 个信源68° AI 热度最后更新 2026/8/14 16:58:21

证据链

冲突核查

现有去重数据只说明这些来源讨论同一事件,不代表立场相同。当前没有结构化的支持或反驳证据,不自动推断冲突。

查看资讯详情