Qwen3.6-35B-A3B 在 MacBook Pro 上性能测试

We benchmark Qwen3.6-35B-A3B on an M5 Max MacBook Pro. Across ten prompt lengths and ten decode con...

精选理由

Qwen3.6-35B-A3B 在苹果笔记本上跑得比 MLX-LM 还快,吞吐量提升超 20%,质量不打折。

AI 摘要

Qwen3.6-35B-A3B 在 M5 Max MacBook Pro 上进行了基准测试。该模型在十种提示长度和十种解码上下文中表现优异。相比 MLX-LM,Qwen3.6-35B-A3B 的预填充吞吐量平均高出 1.23 倍。解码吞吐量平均高出 1.35 倍,同时输出质量基本保持不变。

原文 · Perplexity

We benchmark Qwen3.6-35B-A3B on an M5 Max MacBook Pro. Across ten prompt lengths and ten decode con...

We benchmark Qwen3.6-35B-A3B on an M5 Max MacBook Pro. Across ten prompt lengths and ten decode contexts, Lily was faster than MLX-LM, averaging 1.23× higher prefill throughput and 1.35× higher decode throughput while keeping output quality effectively unchanged. 💬 1 🔄 0 ❤️ 0 👀 84 📊 1 ⚡