苹果 iOS 27 爆料:用 Gemini 训练本地 AI,部分 Siri 请求转向谷歌云

精选理由

苹果终于把 Gemini 用在了自家 AI 上——用蒸馏技术做本地模型,同时把部分 Siri 请求外包给谷歌云。做隐私合规或苹果生态开发的团队值得关注,这可能是未来端云混合 AI 的样板。

AI 摘要

科技媒体 The Information 爆料苹果与谷歌在 AI 方面的合作细节。苹果采用知识蒸馏技术,基于谷歌 Gemini 模型训练轻量端侧 AI 模型,使其能在 Apple 设备本地运行,以提升响应速度和保护隐私。同时,为减轻服务器压力,iOS 27 的部分 Siri 请求将转向 Google Cloud 调用 Gemini 模型处理。苹果还批准采用 NVIDIA 的机密计算技术,在云端处理时加密数据,以平衡隐私与性能。此举表明苹果在 AI 部署上坚持隐私优先,同时借助外部力量弥补自身算力不足。

原文 · IT之家

IT之家 5 月 29 日消息,科技媒体 The Information 昨日(5 月 28 日)发布博文,深度披露苹果和谷歌在 AI 方面的合作细节。 在部署策略方面, 苹果始终围绕着隐私优先原则,深耕本地端侧 AI 处理方案, 使用“蒸馏”(Distillation)方案,基于谷歌 Gemini 模型来训练轻量端侧 AI 模型。 IT之家注:知识蒸馏,是指将大模型(教师模型)的知识迁移到小模型(学生模型)的技术,让小模型获得接近大模型的表现,从而大幅降低推理成本。 消息称苹果 AI 团队正从充分调用谷歌 Gemini 模型,“教”出一个更轻量的版本,让它能在 Apple 设备端运行。 对于用户而言,在端侧运行 AI 模型响应更快,且用户数据不必默认上传到云端,更符合 Apple 近年反复强调的隐私路线。 苹果公司还在积极物色寻找初创公司,帮助压缩模型规模。消息称苹果公司曾考虑收购 Liquid AI。后者是一家位于美国马萨诸塞州剑桥的初创公司,方向正是让 AI 模型在设备本地运行。 在云端部署方面,完整 Gemini 模型拥有数万亿参数,对算力要求极高,苹果自家的 Private Cloud Compute 基础设备难以承接所有运行要求。 消息源称,为了减轻苹果服务器压力,在 iOS 27 版 Siri 中,部分用户提出的请求会转到 Google Cloud,并调用授权版本的 Gemini 模型处理。 为了尽量守住隐私承诺,苹果最近几周据称批准采用 NVIDIA 的“机密计算”技术。该技术会在 GPU 处理数据和模型时加密内容,代价是云端 AI 查询速度会略微变慢,但能提高敏感信息的保护强度。 如果最终落地,苹果在云端跑部分 AI 功能时,可能会同时依赖 Google Cloud 与 NVIDIA AI 芯片。