№bonsai27b·general
Bonsai 27B
别名
- 首次出现
- 2026-07-14
- 最近出现
- 2026-07-28
- 累计提及
- 14
§ 01综述
Bonsai 27B 是一个基于 Qwen3.6-27B 的推理模型,通过极致的 1-bit 和三元量化技术将参数量 27B 的模型压缩至内存占用仅 3.9GB(原需 54GB),从而首次实现在 iPhone 等移动设备上本地运行。该模型由 PrismML 于 2026 年 7 月发布,主打边缘端部署,同时保留多模态推理能力。
Bonsai 27B 近期进展
2026 年 7 月 14 日:PrismML 正式发布 Bonsai 27B,声称这是首个能在手机上运行的 27B 参数模型。量化后模型大小约 4GB,可在 iPhone 17 Pro 上以接近 30 token/s 的速度运行。 原文标题:PrismML 发布 Bonsai 27B:Qwen3.6-27B 的 1-bit 和三元量化版本,可在笔记本和手机上运行
同日:Together AI 官方确认支持 Bonsai 27B,并通过 Claude Code 等工具开放调用。模型在 iPhone 上的推理速度达到每秒 15-30 token。 原文标题:Bonsai 27B:手机级尺寸的 27B 多模态模型
量化技术细节:PrismML 采用 Prism 量化算法,将模型权重从 FP16 压缩为 1.58-bit(三元值 {-1,0,1}),内存占用从 54GB 急剧降至 3.9GB,同时保持与原始模型接近的准确率。 原文标题:内存占用 54GB→3.9GB,苹果评估 PrismML 量化技术让 iPhone 15 运行 27B 模型
当前焦点与观察点
Bonsai 27B 的发布标志着大模型边缘端部署取得关键突破——此前 27B 级别模型必须依赖云端 GPU。其核心争议点在于:极低比特量化是否显著牺牲了模型能力?PrismML 公布的基准测试显示,在 GSM8K、MMLU 等任务上,Bonsai 27B 得分与原版 Qwen3.6-27B 差距在 5% 以内,但实际复杂推理场景的损耗尚待第三方验证。此外,该模型仅支持 iPhone 17 Pro(A18 Pro 芯片及以上),兼容性有限。未来若能在 Android 旗舰设备上落地,或将对移动 AI 应用生态产生深远影响。