主要来源PyTorch
查看原文事件专题 ·多源确认
PyTorch推出原生TPU后端引擎vLLM和SGLang
Google和Meta工程师将在PyTorch Conference North America介绍基于TorchTPU的新vLLM和SGLang引擎。这些引擎使现有基础设施能在TPU上原生运行,保留GPU用户熟悉的调度器、批处理系统和OpenAI兼容API。新模型和功能可在TPU上运行,无需单独的TPU实现,生产环境运行经验包括编译时间、设备放置和KV缓存布局。
当前结论
Google和Meta工程师将分享如何让vLLM和SGLang在TPU上原生运行,保留GPU用户熟悉的API和工作流。
11 个信源76° AI 热度最后更新 2026/10/1 20:47:01
证据链
11 个信源冲突核查
现有去重数据只说明这些来源讨论同一事件,不代表立场相同。当前没有结构化的支持或反驳证据,不自动推断冲突。