LM Studio 与苹果合作,成功用四台 Mac Studio 运行万亿参数 Kimi K2.6 大模型

精选理由

LM Studio 用四台 Mac Studio 跑起万亿参数的 Kimi K2.6,还能用 iPhone 远程调用,给消费级本地部署开了个好头。

AI 摘要

LM Studio 与苹果在 WWDC 2026 期间合作,用四台 Mac Studio 集群成功运行月之暗面万亿参数大模型 Kimi K2.6。Kimi K2.6 总参数达 1 万亿,采用 MoE 架构,激活参数 320 亿,支持长上下文、多模态输入和智能体任务。四台 Mac Studio 通过 Thunderbolt 5 RDMA 内存共享形成约 1.5TB 统一内存,实现模型推理。演示还展示 LM Link 功能,用户可从 MacBook Neo 或 iPhone 安全远程访问集群模型,数据保持本地处理。在类似配置下,模型生成速度约 28 tokens/s,功耗低于传统 GPU 集群。

原文 · IT之家

IT之家 6 月 20 日消息,在苹果 WWDC 2026 期间,LM Studio 与苹果合作在四台 Mac Studio 集群上成功运行起了月之暗面万亿参数大模型 Kimi K2.6,并通过 LM Link 实现从 MacBook Neo 和 iPhone 的安全远程访问。 IT之家此前报道,Kimi K2.6 大模型总参数规模达到 1 万亿,采用 MoE 架构,激活参数为 320 亿,支持长上下文、多模态输入以及智能体任务处理。 据 LM Studio 官方介绍,在此次演示中,四台 Mac Studio 通过苹果的内存共享和互联技术形成集群,总统一内存容量达到约 1.5TB,能够承载这一前沿规模模型的推理需求。其演示还展示了使用 LM Link 功能,从 MacBook Neo 笔记本电脑和 iPhone 上进行安全远程访问的操作场景,用户可在这些设备上与集群上运行的模型进行交互,而数据和通信保持本地化处理。 此前有开发者测试显示,在类似四台 Mac Studio 集群配置下,Kimi K2.6 模型在特定模式下可达到约 28 tokens/s 的生成速度,功耗相对传统 GPU 集群较低。LM Studio 作为本地 AI 模型运行平台,此次与苹果的合作进一步展示了在消费级硬件上部署大型开源模型的可能性。 这一演示凸显了苹果生态在 AI 本地化部署方面的技术进展,包括 Thunderbolt 5 RDMA 支持等多设备内存共享能力。LM Link 作为 LM Studio 的远程访问功能,已于 2026 年 6 月初更新至其 Mac 应用和 Locally AI iOS 应用中,支持端到端加密连接。 相关阅读: 《 LM Studio 上线 LM Link,让 iPhone 17 等直连 Mac 本地 AI 模型 》

LM Studio 与苹果合作,成功用四台 Mac Studio 运行万亿参数 Kimi K2.6 大模型 · AI 热点