00:29官方账号Decoder@Jonathan KemperPrismML将27B参数模型Bonsai 27B压缩至4GB以下,使其能在iPhone上本地运行。在内部基准测试中,最小版本保留原模型90%的性能,数学和编码分数几乎未受影响。Apple据报正在测试该压缩技术,有望推动端侧AI发展。Bonsai 27B是一个完全开源的推理模型。AI模型Bonsai 27BPrismMLiPhone推荐理由:PrismML把27B模型压到4GB还能跑在iPhone上,苹果都在试,看看本地AI能有多强。原文稍后读已读值得跟进有用关注 Bonsai 27B
22:20官方账号Together AI@togethercompute精选PrismML发布了Bonsai 27B,一个270亿参数的多模态模型,能在手机级设备上本地运行。该模型采用三元量化技术压缩体积,同时保留图像理解等多模态能力。用户现可通过Together AI平台在线试用。这是本地AI在参数量和设备适配上的重要进展。AI模型Bonsai 27BPrismMLTogether AI推荐理由:27B参数的多模态模型能塞进手机?Bonsai 27B做到了,性能还很强,快试试。原文稍后读已读值得跟进有用关注 Bonsai 27B
10:18IT之家(博客/媒体)PrismML 的原生 1-bit 模型压缩技术可将模型体积压缩至全精度的 1/14,内存占用降低超 90%。基于该技术的 Bonsai 27B 模型(基于 Qwen 3.6 27B)从约 54GB 缩减至不足 4GB,可在 12GB 内存的 iPhone 15 及后续机型上原生运行。推理速度提升最高 8 倍,能耗降低 75%-80%,精度在 1-bit 下保留 90% 基准得分。苹果公司正在评估 PrismML 技术,会谈可能涉及授权或收购。AI模型PrismMLBonsai 27B苹果推荐理由:PrismML 这技术能把 27B 模型塞进 iPhone,内存从 54G 砍到 4G 不到,苹果都在看,手机跑大模型要成真了。原文稍后读已读值得跟进有用关注 PrismML
08:53Paul Couvert@itsPaulAiPrismML今天推出Bonsai 27B,首个能在手机上运行的27B参数多模态模型。基于Qwen3.6 27B,提供两个变体:三元版5.9GB(1.71位/权重)和1-bit版3.9GB(1.125位/权重)。该模型支持多步推理、结构化工具使用和长上下文智能体循环。全部代码和权重已开源(Apache 2.0),此前运行类似模型需要千美元级电脑。AI模型Bonsai 27BPrismMLQwen3.6推荐理由:27B模型能塞进手机,3.9GB就跑得动,还完全开源。手机党不用再羡慕桌机了。原文稍后读已读值得跟进有用关注 Bonsai 27B
08:40berryxia@berryxia73°PrismML推出Bonsai 27B模型,可在iPhone 17 Pro上直接运行,内存占用低于5GB。这是首个在手机端运行的27B参数级模型。演示视频显示实时响应且可用。通过量化技术将内存压缩至极致,同时保持模型可用性。该模型表明27B规模的大模型开始走进个人设备。AI模型PrismMLBonsai 27BiPhone 17 Pro1 个信源在谈事件专题推荐理由:27B的模型在手机上跑,内存不到5GB,PrismML的Bonsai做到了。以后手机AI不连网也能用大模型了。原文稍后读已读值得跟进有用关注 PrismML
08:37berryxia@berryxiaPrismML发布Bonsai 27B,这是首个能在手机上本地运行的27B级多模态模型。该模型通过端到端低比特技术,1-bit版本仅3.9GB,可在iPhone 17 Pro上运行;Ternary版本5.9GB,适合笔记本。其智能密度达0.53 per GB,比全精度基线高约10倍,比现有最佳低比特方案高2.7倍。在15个基准测试中,Ternary版平均保留95%性能,1-bit版保留90%,数学、编码和工具调用能力接近原版Qwen3.6 27B。模型已开源(Apache 2.0),支持GGUF格式,提供一键运行Demo和免费开发者预览API。AI模型Bonsai 27BPrismML多模态推荐理由:PrismML搞了个Bonsai 27B,在手机上就能跑27B多模态模型,压缩到3.9GB性能还能保留90%,挺牛的,还开源了,可以试试。原文稍后读已读值得跟进有用关注 Bonsai 27B
07:27AK@_akhaliqBonsai 27B 模型现可通过 Hugging Face 的 hf claude 集成在 Claude Code 中直接调用。该模型拥有 270 亿参数,是专为代码和推理任务设计的大型语言模型。用户无需额外配置即可在 Claude Code 环境内无缝使用 Bonsai 27B 进行代码生成、调试与分析。此次整合降低了模型部署门槛,使得开发者能更快在专业代码场景中利用该模型的能力。AI模型Bonsai 27BClaude CodeHugging Face推荐理由:现在你直接在 Claude Code 里就能调用 Bonsai 27B 了,不用自己部署,省事。原文稍后读已读值得跟进有用关注 Bonsai 27B
07:06IT之家(博客/媒体)PrismML 推出 Bonsai 27B 模型,基于 Qwen 3.6 27B 微调,通过 1-bit 量化仅需 3.9GB 空间,能在 12GB 内存的 iPhone 上运行。该模型保留原模型 90% 智能水平,支持多步推理和工具使用。推出 3-bit(5.9GB)和 1-bit(3.9GB)两个版本,分别面向笔记本和手机场景。AI模型Bonsai 27BQwen 3.6iPhone 17 Pro1 个信源在谈事件专题推荐理由:PrismML 把 Qwen 3.6 27B 压缩到 3.9GB,iPhone 17 Pro 直接跑,本地 AI 终于不卡了。原文稍后读已读值得跟进有用关注 Bonsai 27B
07:00官方一手marktechpost@Asif RazzaqPrismML 推出了 Bonsai 27B,这是对 Qwen3.6-27B 进行低比特量化得到的模型,不修改原架构。三元版本使用 {−1, 0, +1} 权重,每个参数仅 1.71 bits,理想大小 5.9GB。1-bit 版本采用二进制 {−1, +1} 权重。两个版本均以 Apache 2.0 许可开源,可在笔记本和手机上本地运行。AI模型PrismMLBonsai 27BQwen3.6-27B推荐理由:PrismML 把 Qwen3.6-27B 压到 5.9GB,手机都能本地跑,还全开源,适合离线使用。原文稍后读已读值得跟进有用关注 PrismML
04:39elvis@omarsar0精选PrismML 今日发布 Bonsai 27B,这是首个可在手机上本地运行的 27B 参数多模态模型。基于 Qwen3.6 27B,Bonsai 27B 支持多步推理、结构化工具使用、长上下文和智能体循环。Ternary 变体仅 5.9 GB(1.71 有效比特/权重),1-bit 变体仅 3.9 GB(1.125 有效比特/权重),大幅降低本地部署门槛。在 RTX 5090 上,1-bit 版本达到 163 tok/s,Ternary 版本达到 134 tok/s;在 M5 Max 上分别为 87 tok/s 和 58 tok/s。模型以 Apache 2.0 许可证开源。AI模型Bonsai 27BPrismMLQwen3.6推荐理由:手机能跑 27B 模型了?PrismML 的 Bonsai 27B 实际做到了——体积最小 3.9GB,速度还不慢,开源免费。想本地用大模型又嫌大的可以看。原文稍后读已读值得跟进有用关注 Bonsai 27B