这个模型采用了混合专家(MoE)设计,意味着在任何特定查询中,它只会激活相关的一小部分参数——这种设定既保有了万亿参数系统的知识容量,又能将响应延迟控制在媲美小得多的模型的水准 。苹果自己此前最大的云端模型,其规模大约只有这个模型的八分之一。而且在测试过程中,该公司自家的“私有云计算”(Private Cloud Compute)服务器被指速度太慢,无法高效承载如此规模的模型 。
在处理最繁重的 Siri AI 请求时,数据路径会经过搭载 Nvidia Blackwell B200 GPU 的谷歌云 。其集成可分解为三个部分:
苹果自研的第三代“Apple 基础模型”(AFM)负责处理绝大多数设备端任务。只有当查询超出本地容量时,才会触发向云端的交接 。
隐私故事是苹果叙事的核心,它横跨三个明确的层级 :
苹果确认,数据在每一次跳转中都是匿名的,且所有服务器组件和软件都遵循与苹果自有 PCC 节点一样的、可验证的透明度承诺 。
实际的路由逻辑是:简单任务永不离开设备;中等任务进入苹果 PCC;真正困难的推理请求才会抵达谷歌云——每一个层级都具有同等的隐私保证。
苹果和谷歌建立的是许可和工程合作伙伴关系,而不是一项面向消费者的合作 。区别至关重要:
简而言之,谷歌提供基础模型和云端芯片;苹果提供产品、交互界面、设备端模型和隐私架构。用户永远不会触碰到谷歌的界面。
苹果已确认,Siri AI 的公开测试版将随 iOS 27 在 2026 年 9 月发布,这恰逢新款 iPhone 硬件的预期发布时间 。也有报道提到七月的公开测试版,不过主题演讲中强调的是九月这个时间范围 。届时,一个能够通过 iCloud 同步对话历史的独立 Siri App 也会同步到来 。
测试版之后的稳定版预计在 2026 年晚些时候到来;苹果官方网站使用了“今年晚些时候”这一措辞,并未给出确切日期。据报道,这让一些原本期待九月就能见到正式版的投资者感到不安 。
细则里有实实在在的限制:
Siri AI 是苹果有史以来最大的一场 AI 豪赌,它建立在每年 10 亿美元、与其最大平台级竞争对手握手言和的基础之上。这套架构——三个层级,三家公司,一套可验证的隐私模型——要么是保护隐私的云端 AI 蓝图,要么是消费科技史上最精心设计的一场信任实验。九月的测试版将开始揭晓答案。