模型76°02:16DFlash + Spec V2 推测解码:LLM推理吞吐量提升4.3倍以上LMSYS 和 Modal 联手推出了 DFlash,让 Qwen 3.5 的推理速度比原生 MTP 快 1.5 倍,比基线快 4.3 倍,代码已开源,玩起来!#DFlash#Spec V2#SGLang#推测解码官方账号LMSYS Org (SGLang)@lmsysorg原文稍后读已读值得跟进有用关注 DFlash