主要来源LMSYS Org (SGLang)
查看原文事件专题 · 多源确认
NVIDIA发布Qwen3.6-27B-NVFP4,4位浮点权重支持SGLang
NVIDIA推出Qwen3.6-27B-NVFP4模型,采用4位浮点量化,模型大小仅为BF16版本的约1/2.5。该模型在MMLU Pro基准上达到86.3分,与FP8版本性能几乎无损。上下文长度完整保留262K。SGLang已提供Day-0支持,并附带cookbook。
当前结论
NVIDIA新出的Qwen3.6-27B模型,4位量化体积小很多但精度没怎么降,SGLang直接就能用,可以去试试。
10 个信源76° AI 热度最后更新 2026/7/2 15:29:39
证据链
相关来源 1vLLM
查看原文相关来源 2IT之家
查看原文相关来源 3AWS Machine Learning Blog
查看原文相关来源 4NVIDIA AI
查看原文相关来源 5量子位
查看原文相关来源 6Jim Fan
查看原文相关来源 7Nous Research
查看原文相关来源 8marktechpost
查看原文相关来源 9The Rundown AI
查看原文冲突核查
现有去重数据只说明这些来源讨论同一事件,不代表立场相同。当前没有结构化的支持或反驳证据,不自动推断冲突。