主要来源vLLM
查看原文事件专题 · 多源确认
Qwen3.6-27B-NVFP4发布,vLLM支持Blackwell GPU推理
Qwen3.6-27B-NVFP4模型在vLLM上可用,针对NVIDIA Blackwell GPU优化。该检查点将GPU内存需求降低约2.5倍。模型拥有27B参数,采用混合注意力机制。在MMLU Pro上得分86.3,GPQA Diamond上得分85.5。仅支持vLLM作为运行时引擎。
当前结论
Qwen3.6-27B-NVFP4来了!在Blackwell上内存减半,MMLU Pro 86.3分,用vLLM就能跑,开源模型本地AI更省显存。
11 个信源72° AI 热度最后更新 2026/7/2 12:29:31
证据链
相关来源 1LMSYS Org (SGLang)
查看原文相关来源 2IT之家
查看原文相关来源 3量子位
查看原文相关来源 4marktechpost
查看原文相关来源 5arXiv cs.AI
查看原文相关来源 6Decoder
查看原文相关来源 7Jim Fan
查看原文相关来源 8Nous Research
查看原文相关来源 9NVIDIA AI
查看原文相关来源 10OpenRouter
查看原文冲突核查
现有去重数据只说明这些来源讨论同一事件,不代表立场相同。当前没有结构化的支持或反驳证据,不自动推断冲突。