6月4日,据海外科技媒体the information昨日披露,苹果即将推出的ios 27系统将对siri实施深度ai架构升级。针对部分高复杂度ai查询任务,系统将不再完全依赖苹果自有算力资源,而是通过google cloud接入经谷歌授权定制的gemini大模型;相关云端推理运算将统一由部署在谷歌侧的英伟达blackwell b200高性能gpu集群承担。

图源X平台@9to5Mac,下同
苹果一贯坚持“隐私优先”战略,为Siri设计了终端本地处理与自有私有云协同的双轨运行机制:常规语音指令、基础信息检索等轻量级任务均由设备端小型模型完成,用户数据全程保留在本地,充分契合其核心隐私理念。然而,随着生成式AI能力持续演进,Siri新增的长文本摘要生成、跨模态综合问答等功能对算力提出更高要求。受限于自建私有云的规模与弹性,苹果难以全面支撑万亿参数级Gemini模型的实时推理负载,服务器压力持续攀升。在此背景下,苹果决定引入跨企业算力协作模式,将高阶Siri请求定向分流至谷歌云平台执行。

此次合作所采用的Blackwell B200 GPU,属于英伟达最新一代Blackwell架构数据中心级产品,专为超大规模语言模型训练及低延迟云端推理场景优化,是当前商用AI基础设施中性能最强的算力单元之一,可高效满足Gemini等万亿参数模型的实时响应需求。
为应对数据跨境传输可能引发的隐私风险,苹果同步部署英伟达硬件级机密计算(Confidential Computing)技术。该机制可在B200芯片执行用户请求的全过程中实现端到端硬件加密保护。据英伟达官方说明,该技术已覆盖Blackwell、Hopper等全系旗舰GPU,确保AI模型运行期间敏感用户数据的完整性与机密性,显著提升第三方共享云环境下的数据安全水位。目前该方案正处在最终落地准备阶段,完整版Siri AI功能预计随iOS 27正式版同步上线。
图源X平台@zubiqo
编辑点评:苹果此次打破纯自研路径,携手谷歌与英伟达构建联合AI算力体系,是在全球AI军备竞赛加速背景下的理性抉择。固守全链路自研与100%本地化处理策略,已难以匹配大模型快速迭代节奏;而“端云协同+可信第三方算力”正成为兼顾性能、时效与安全的现实最优解。此举不仅大幅加快Siri智能化能力落地进程,也印证了终端厂商短期内独立打造具备竞争力的大模型仍面临显著挑战。展望未来,“自研模型+外部高性能算力采购”或将逐步演变为智能手机行业AI演进的主流范式。

















