事件专题 ·多源确认

PyTorch推出原生TPU后端引擎vLLM和SGLang

Google和Meta工程师将在PyTorch Conference North America介绍基于TorchTPU的新vLLM和SGLang引擎。这些引擎使现有基础设施能在TPU上原生运行,保留GPU用户熟悉的调度器、批处理系统和OpenAI兼容API。新模型和功能可在TPU上运行,无需单独的TPU实现,生产环境运行经验包括编译时间、设备放置和KV缓存布局。

当前结论

Google和Meta工程师将分享如何让vLLM和SGLang在TPU上原生运行,保留GPU用户熟悉的API和工作流。

11 个信源76° AI 热度最后更新 2026/10/1 20:47:01

证据链

11 个信源
相关来源 2Rappler: Technology
查看原文

冲突核查

现有去重数据只说明这些来源讨论同一事件,不代表立场相同。当前没有结构化的支持或反驳证据,不自动推断冲突。