06:57Aravind Srinivas@AravSrinivas78°Perplexity开源了Lily本地推理引擎,专为Apple Silicon上的Qwen3.6-35B-A3B模型优化。该引擎支持Perplexity Computer的混合计算功能,确保设备端计算不会成为瓶颈。Lily是Perplexity Mac应用混合计算功能的核心组件。AI产品PerplexityLilyQwen3.6-35B-A3B推荐理由:Perplexity开源了专为Apple Silicon优化的Lily推理引擎,让Qwen3.6-35B-A3B在本地运行更高效。原文稍后读已读值得跟进有用关注 Perplexity
04:43官方账号Perplexity@perplexity_ai78°Perplexity发布了名为Lily的本地推理引擎,专为Qwen3.6-35B-A3B模型在Apple硅芯片上优化。该引擎解决了设备端计算瓶颈问题,支持混合计算架构。Lily是Perplexity Computer的核心组件,现已开源。AI产品LilyQwen3.6-35B-A3BPerplexity推荐理由:Perplexity开源了专为Apple芯片优化的Lily推理引擎,解决Qwen3.6-35B-A3B的本地计算瓶颈问题。原文稍后读已读值得跟进有用关注 Lily
04:43官方账号Perplexity@perplexity_aiQwen3.6-35B-A3B 在 M5 Max MacBook Pro 上进行了基准测试。该模型在十种提示长度和十种解码上下文中表现优异。相比 MLX-LM,Qwen3.6-35B-A3B 的预填充吞吐量平均高出 1.23 倍。解码吞吐量平均高出 1.35 倍,同时输出质量基本保持不变。AI模型Qwen3.6-35B-A3BMLX-LMMacBook Pro推荐理由:Qwen3.6-35B-A3B 在苹果笔记本上跑得比 MLX-LM 还快,吞吐量提升超 20%,质量不打折。原文稍后读已读值得跟进有用关注 Qwen3.6-35B-A3B