
(AI云资讯消息)苹果新版 Siri 由定制的谷歌 Gemini 云端模型驱动,原本计划在苹果自研芯片上运行。但苹果的自有服务器难以承载谷歌这么庞大的模型,迫使苹果不得不采用一种基于英伟达GPU的临时解决方案,以保住仅存的一点隐私信誉。与此同时,还得把驱动 Siri 的 Gemini 模型托管在谷歌的服务器上。
据报道,即将推出的聊天机器人式 Siri 将谷歌Gemini模型的一个更先进版本,该模型在苹果内部被称为Apple Foundation Models 11。据古尔曼称,这一模型预计将与Gemini 3相媲美,并且远比目前支持新版Siri的模型强大得多。
与此同时,苹果还在通过一种名为蒸馏的技术,训练一系列较小的端侧模型。这项技术能让这些“学生模型”获得其“教师模型”所拥有的部分相同能力,而这里的“教师模型”,就是苹果获授权使用的谷歌 Gemini 模型。
然而,考虑到谷歌定制的 Gemini 模型拥有数万亿参数,苹果一直难以在自家名为“私有云计算”的定制服务器网络中容纳它。因此,新版 Siri 的部分用户请求将直接由谷歌云上获授权的 Gemini 模型来处理,以确保最佳推理效果。
由于谷歌定制的 Gemini 模型拥有数万亿参数,苹果难以在自家名为“私有云计算”的定制服务器网络中容纳它。因此,新版 Siri 的部分用户请求将直接由谷歌云上获授权的 Gemini 模型来处理,以确保最佳推理效果。
目前,苹果倾向于在谷歌的服务器内部署英伟达 B200 GPU,主要是因为这些 GPU 自带内置加密功能,可以在数据处理过程中对其进行加密。
英伟达宣称,该功能能保护部署在 Rubin、Blackwell 和 Hopper GPU 上的 AI 模型的机密性与完整性,同时让敏感的 AI 工作负载能够以接近原生的性能,安全地大规模运行,即使在共享或云环境中也是如此。
这一步应该有助于苹果向其用户保证,他们的数据不会被谷歌窃取,这在当前的现实条件下,已是可能达成的最佳妥协方案。