#PrismML
共 17 条 · 7 天 0 条 · 30 天 4 条
信息流里打上「PrismML」标签的资讯、产品与论文,按刊登时间排,新的在上。
9月25日
9月24日
高通联合 PrismML 在骁龙 AR1 Gen 1 上跑通 1-bit Bonsai 视觉模型
AI 眼镜不用联网也能识图问答了,1-bit 量化让 2B 模型塞进眼镜芯片,速度翻倍、功耗还降,端侧玩法的实用参考。
IT之家原文
9月18日
PrismML 发布 Bonsai 2 27B,以 1/9 内存占用实现 Qwen3.8 98.2% 性能
PrismML 新出的 Bonsai 2 27B 模型,内存占用只有 Qwen3.8 的 1/9,性能还比 Qwen3.6 更好,适合本地部署做编程智能体。
IT之家原文
7月28日
用PrismML llama.cpp部署1位Bonsai-27B模型及本地推理工作流
想本地跑Bonsai-27B?用PrismML的llama.cpp加上1位量化,速度起飞,还能直接用OpenAI API调用。
7月16日
7月15日
PrismML 将 Qwen3.6-27B 压到 3.9GB 在 iPhone 上运行,保留 90% 性能
PrismML 把 27B 大模型压到几 GB 还能在手机上跑,性能几乎没缩水,iPhone 用户也能本地跑大模型了。
内存占用 54GB→3.9GB,苹果评估 PrismML 量化技术让 iPhone 15 运行 27B 模型
PrismML 这技术能把 27B 模型塞进 iPhone,内存从 54G 砍到 4G 不到,苹果都在看,手机跑大模型要成真了。
IT之家原文
PrismML发布Bonsai 27B:首个能在iPhone 17 Pro运行的27B模型
27B的模型在手机上跑,内存不到5GB,PrismML的Bonsai做到了。以后手机AI不连网也能用大模型了。
模型08:37
PrismML发布Bonsai 27B:可在手机本地运行的27B多模态模型PrismML搞了个Bonsai 27B,在手机上就能跑27B多模态模型,压缩到3.9GB性能还能保留90%,挺牛的,还开源了,可以试试。
PrismML 发布 Bonsai 27B:Qwen3.6-27B 的 1-bit 和三元量化版本,可在笔记本和手机上运行
PrismML 把 Qwen3.6-27B 压到 5.9GB,手机都能本地跑,还全开源,适合离线使用。
PrismML 发布 Bonsai 27B,多模态模型可在手机上本地运行
手机能跑 27B 模型了?PrismML 的 Bonsai 27B 实际做到了——体积最小 3.9GB,速度还不慢,开源免费。想本地用大模型又嫌大的可以看。
7月10日
苹果评估PrismML 1-bit压缩技术,Qwen 3.6已在iPhone 17 Pro运行
苹果想用这技术让27B的Qwen 3.6在手机上跑,速度比原来快8倍,能耗降75%,还能保持精度,挺牛的。
IT之家原文
5月27日
模型07:22
PrismML 发布 Bonsai Image 4B 端侧生图模型,1-bit 版仅 0.93GB端侧生图终于不再妥协——Bonsai Image 4B 用极致压缩把云端级质量塞进手机,做移动端 AI 应用或离线创作工具的开发者可以直接在 iPhone 上试,无需联网和付费。