事件专题 · 多源确认

Qwen3.8-27B发布:单GPU跑1M上下文,vLLM Day-0支持

阿里发布 Qwen3.8-27B,单张 Blackwell GPU 即可部署,原生上下文 262K,可扩展至 1M。模型采用与 2.4T 旗舰相同的混合骨干架构,但为 dense 而非 MoE。vLLM 提供 Day-0 支持,内置 MTP 草稿头,短提示词接受率在 BF16 下为 92.2%、FP8 下为 84.8%。在 NVIDIA GB300 上完成端到端验证,支持 BF16/FP8 TP4 与 NVFP4 TP1,工具调用和 1M 上下文生成均正常。

当前结论

阿里发了能塞进单卡GPU的27B模型,长上下文到1M,vLLM当天就能用。适合想自己部署长上下文开源模型的开发者。

4 个信源81° AI 热度最后更新 2026/8/14 15:50:30

证据链

冲突核查

现有去重数据只说明这些来源讨论同一事件,不代表立场相同。当前没有结构化的支持或反驳证据,不自动推断冲突。

查看资讯详情