Qwen3.8-27B

product · 首次出现 2026-08-03 · 最近出现 2026-09-12 · 累计提及 55

综述

Qwen3.8-27B是阿里巴巴通义Qwen团队最新发布的27B参数规模开源大语言模型。该模型在编程和办公任务上表现优于前代Qwen3.7-Plus,现已正式上线并可通过Ollama平台使用。

Qwen3.8-27B 近期进展

  • 2023年8月,Qwen3.8-27B正式登陆Ollama平台,用户可接入Claude Code等工具。Ollama 联合阿里 Qwen,Qwen3.8-27B 正式上线
  • Qwen3.8-27B可在17GB内存的设备上本地运行,Unsloth团队已发布其量化版本。Qwen3.8-27B 可在 17GB 内存本地运行,Unsloth 发布量化版
  • 该模型支持单GPU运行,在RTX 5090显卡上可达到206 tokens/秒的推理速度。Qwen3.8-27B开源,SGLang Day-0支持单卡RTX 5090跑206 tok/s
  • Qwen3.8-27B支持高达1M tokens的上下文长度,vLLM在发布首日即提供支持。Qwen3.8-27B发布:单GPU跑1M上下文,vLLM Day-0支持
  • 当前焦点与观察点

    Qwen3.8-27B的发布标志着开源大模型在本地化部署和效率优化方面的新进展。17GB内存的本地运行能力降低了普通开发者的使用门槛,而206 tokens/秒的推理速度则提升了实际应用体验。AMD对该模型的首发支持也反映了硬件厂商与AI软件生态的深度融合。随着大模型参数规模持续增长,如何在有限硬件资源上高效运行将成为行业共同关注的焦点。同时,1M tokens的上下文支持为处理长文本任务提供了可能,这可能改变大模型在文档分析和知识检索等领域的应用方式。

    相关报道

    10 条在档