主要来源阿里通义 Qwen
查看原文事件专题 · 多源确认
Qwen3.8-Flash-Next在NVIDIA和AMD上运行
@vllm_project使Qwen3.8-Flash-Next从第一天起就在NVIDIA和AMD上运行,超稀疏多模态MoE模型,125B参数,6B活跃,262K本地,1M通过YaRN,额外51B N-gram表可卸载,Qwen Sparse Attention是新的引擎工作所在。
当前结论
@vllm_project让Qwen3.8-Flash-Next在NVIDIA和AMD上无缝运行,新模型带来更多可能性,值得一看!
9 个信源67° AI 热度最后更新 2026/8/26 13:17:23
证据链
相关来源 1marktechpost
查看原文相关来源 2lmarena.ai
查看原文相关来源 3IT之家
查看原文相关来源 4Decoder
查看原文相关来源 5orange.ai
查看原文相关来源 6The Rundown AI
查看原文相关来源 7Perplexity
查看原文相关来源 8Aravind Srinivas
查看原文冲突核查
现有去重数据只说明这些来源讨论同一事件,不代表立场相同。当前没有结构化的支持或反驳证据,不自动推断冲突。