23:29官方账号LMSYS Org (SGLang)@lmsysorg76°NVIDIA推出Qwen3.6-27B-NVFP4模型,采用4位浮点量化,模型大小仅为BF16版本的约1/2.5。该模型在MMLU Pro基准上达到86.3分,与FP8版本性能几乎无损。上下文长度完整保留262K。SGLang已提供Day-0支持,并附带cookbook。AI模型Qwen3.6-27B-NVFP4NVIDIASGLang9 个信源在谈事件专题推荐理由:NVIDIA新出的Qwen3.6-27B模型,4位量化体积小很多但精度没怎么降,SGLang直接就能用,可以去试试。原文稍后读已读值得跟进有用关注 Qwen3.6-27B-NVFP4