苹果首次公开依赖英伟达 GPU 处理 Siri 请求,做 AI 基础设施或关注苹果生态的开发者值得关注——这改变了苹果一贯的本地优先策略,也暗示了未来大模型部署的混合云趋势。
据科技媒体 The Information 报道,苹果计划在 iOS 27 中,将部分 Siri 查询通过 Google Cloud 调用授权版 Gemini 模型,并使用谷歌的 NVIDIA Blackwell B200 集群处理。此举旨在减轻苹果服务器压力,同时利用英伟达的高端 GPU 处理大型 AI 工作负载。为保护隐私,苹果将启用英伟达的机密计算功能,在 GPU 处理数据时进行硬件级加密。这标志着苹果在 AI 策略上进一步依赖外部云服务,同时兼顾隐私保护。
消息称苹果将调用英伟达 Blackwell B200 处理 iOS 27 部分 Siri AI 请求
IT之家 6 月 4 日消息,科技媒体 The Information 昨日(6 月 3 日)发布博文,报道称苹果 iOS 27 版 Siri 部分查询可能通过 Google Cloud 调用授权版 Gemini, 并使用谷歌的 NVIDIA Blackwell B200 集群处理。 IT之家此前援引该媒体报道,苹果公司计划围绕着隐私优先原则,推行本地 + 私有云运行机制,但由于为了减轻苹果服务器压力,在 iOS 27 版 Siri 中,部分用户提出的请求会转到 Google Cloud,并调用授权版本的 Gemini 模型处理。 而该媒体最新报道指出,跳转到 Google Cloud 的相关 Siri 请求会交给谷歌的 NVIDIA Blackwell B200 集群处理。 Blackwell B200 是 NVIDIA 面向数据中心的高端 GPU,基于 Blackwell 架构。NVIDIA 将 Blackwell 定位为大型 AI 训练与推理平台,面向包括万亿参数模型在内的大模型工作负载。 为了降低云端处理带来的隐私顾虑,消息称苹果会启用英伟达的机密计算(confidential compute)功能。该功能属于硬件级安全机制,能在 GPU 处理数据时加密。 英伟达称,这项能力可保护部署在 Rubin、Blackwell 和 Hopper GPU 上的 AI 模型机密性与完整性,并让敏感 AI 工作负载在共享云环境中运行。