主要来源阿里通义 Qwen
查看原文事件专题 · 多源确认
Qwen3.8-27B发布:单GPU跑1M上下文,vLLM Day-0支持
阿里发布 Qwen3.8-27B,单张 Blackwell GPU 即可部署,原生上下文 262K,可扩展至 1M。模型采用与 2.4T 旗舰相同的混合骨干架构,但为 dense 而非 MoE。vLLM 提供 Day-0 支持,内置 MTP 草稿头,短提示词接受率在 BF16 下为 92.2%、FP8 下为 84.8%。在 NVIDIA GB300 上完成端到端验证,支持 BF16/FP8 TP4 与 NVFP4 TP1,工具调用和 1M 上下文生成均正常。
当前结论
阿里发了能塞进单卡GPU的27B模型,长上下文到1M,vLLM当天就能用。适合想自己部署长上下文开源模型的开发者。
4 个信源81° AI 热度最后更新 2026/8/14 15:50:30
证据链
相关来源 1IT之家
查看原文相关来源 2NVIDIA AI
查看原文相关来源 3Julien Chaumond
查看原文冲突核查
现有去重数据只说明这些来源讨论同一事件,不代表立场相同。当前没有结构化的支持或反驳证据,不自动推断冲突。