一句话导读: 大家都在问 Siri 为什么会接上 Google Gemini,但很少有人把「苹果自研模型、Private Cloud Compute、ChatGPT 插件、Gemini 底座」四件事放进同一张图景——下文按战略、架构、合作边界、落地节奏和开发者影响五条线拆开。
先把结论边界说清:不是把 Siri 换成 Gemini App
2026 年 1 月 12 日,Apple 与 Google 发布联合声明:双方达成多年合作,下一代 Apple Foundation Models 将基于 Google 的 Gemini 模型与云技术;这些模型会支撑未来的 Apple Intelligence 功能,包括当年晚些时候更个性化的 Siri。声明同时强调:Apple Intelligence 仍会跑在苹果设备与 Private Cloud Compute 上,并维持苹果一贯的隐私标准。
这和「Siri 变成 Gemini 客户端」完全不是一回事。WWDC 2026 之后,Craig Federighi 的补充更直白:苹果没有把 Gemini App 当成自己的 App,也没有把 Google Search 的知识库原样塞进 Siri。苹果要的是 Gemini 背后的模型能力与云端弹性,用来训练、定制并运行 Apple Foundation Models(AFM)——用户看到的仍是 Siri / Apple Intelligence,而不是一块 Google 的启动图标。
「经过审慎评估,我们认为 Google 的技术能为 Apple Foundation Models 提供最有能力的底座。」——Apple / Google 联合声明(2026-01-12)
把这句话翻译成产品语言:苹果继续控制 体验、路由、隐私承诺和品牌;Google 提供 最难那一档推理所需要的底座与部分云基础设施。谁出现在设置页里 和 谁真正算那一次请求 可以不是同一家公司。
苹果 AI 战略:体验要自有,底座可以外购
过去两年,苹果的公开叙事几乎没变过三条:
- 设备端优先。 能在 Neural Engine 上完成的,就不要出设备。
- 隐私是产品,不是附录。 Private Cloud Compute 被设计成「云端也要像本机一样可审计」。
- AI 必须嵌进系统,而不是再装一个聊天 App。 写作工具、照片、Safari、密码、Siri 都应该「刚好出现在你正在做的事里」。
难的是第三条和前两条互相打架。2024 年 WWDC 亮相的 Apple Intelligence,把 OpenAI 的 ChatGPT 做成 可选的世界知识出口;真正「能懂你的邮件、能跨 App 办事」的新 Siri,却在 2025 年公开延期到 2026。延期的本质不是缺一个聊天框,而是缺一套 足够强、还能按苹果隐私合同交付 的基础模型,去支撑多步推理、个人上下文和 App Intent 调用。
于是苹果做了一个很「苹果」的决定:不把公司命运押在自研最大模型上,也不把系统灵魂交给一个第三方聊天品牌。 自研 AFM 负责「像苹果」;遇到自研节奏跟不上的推理上限,就去买最强的底座。2025 年下半年媒体已报道苹果与 Google 洽谈定制 Gemini、年费约十亿美元量级——2026 年 1 月的联合声明,是把这条线从传闻变成合同。
对苹果来说,Google 比 OpenAI 更「可被放进系统内核」的原因并不神秘:
- 规模与多模态。 Gemini 在长上下文、图文视频、工具调用上的工程厚度,更接近「系统助理」而不是「对话框」。
- 可定制。 联合声明写的是 based on Gemini,不是 is Gemini。苹果要的是可改权重、可改安全层、可改数据驻留的 AFM。
- 云弹性。 峰值推理需要 GPU 集群;苹果自建 PCC 用 Apple silicon 服务器,最重的一档(外界报道中的 AFM Cloud Pro)会走到 Google 数据中心的 NVIDIA GPU,但仍套苹果控制的安全软件与硬件级加密。
- 旧账可用。 Safari 默认搜索、iOS 预装合作已经存在十几年,法务与分成模型不是从零开始。
这并不意味着 ChatGPT 立刻消失。截至 2026 年中,公开口径仍是:ChatGPT 负责用户明确授权后的 外部世界知识;Gemini 底座进入的是 Apple Intelligence / 新 Siri 的地基。两者可以并存,只是层级不同。
Apple Intelligence 现在长什么样
把 2026 年的系统拆成三层,比争论「到底是不是 Gemini」更有用。
| 层级 | 跑在哪 | 典型任务 | 用户能感觉到什么 |
|---|---|---|---|
| 设备端 AFM | iPhone / iPad / Mac 的 Neural Engine + 统一内存 | 通知摘要、改写、本地照片分类、简单语音指令 | 快、可离线、几乎不占蜂窝流量 |
| Private Cloud Compute(PCC) | 苹果自有、基于 Apple silicon 的服务器 | 需要个人上下文、但仍要「像本机一样」处理的复杂请求 | 稍慢一拍,但仍是 Siri / 系统功能,不是跳转到别的 App |
| 峰值云推理(Gemini 云技术) | Google 数据中心 GPU,套 PCC 同级防护 | 多步规划、深层问答、重生成式任务 | 能力上限被抬高;苹果承诺请求不被用来训练对方模型 |
WWDC 2026 把上一层产品化成了 Siri AI:独立 App、可对话、可在信息 / 邮件 / 照片里检索个人内容、可在 App 里执行动作,并与写作工具、Visual Intelligence 打通。开发者测试从 iOS 27 / iPadOS 27 / macOS 27 / visionOS 27 开始;对用户则计划在 2026 年晚些时候以英文 Beta 放出,再扩语言。欧盟的 iPhone 侧、中国大陆的监管路径,官方都单独写了限制——这本身也说明:底座可以外购,上市节奏仍由隐私法与本地合规决定。
同一场发布里,Apple Intelligence 还覆盖了 Photos 的空间重构图与 Extend、Safari 按主题收纳标签页与页面变更通知、Passwords 自动升级弱口令、Image Playground 的写真级生成(带 SynthID 水印)。这些功能并不需要用户「打开 Gemini」。它们需要的是 更强的 AFM,以及一条苹果能签字的云端路径。
Gemini 接了什么,没接什么
用一张清单把边界钉死,避免标题党。
接了的
- 下一代 Apple Foundation Models 的 模型底座与部分训练 / 蒸馏路径。
- 峰值推理所需的 云技术与 GPU 产能。
- 让新 Siri 的多步推理「够用」的能力上限。
没接的
- 系统设置里的默认搜索引擎不一定因此改成 Google(那是另一份合同)。
- Siri 主界面不会变成 Gemini App。
- 个人邮件、消息、照片不会「交给 Google 做广告画像」——至少苹果的公开承诺不是这样写的。
- OpenAI / ChatGPT 的可选集成并未被联合声明宣布终止。
对用户,正确的心智模型是:
你的请求
├─ 简单 → 本机 Neural Engine(AFM On-Device)
├─ 中等 → Apple PCC(AFM Cloud)
└─ 最难 → 套着 PCC 防护的 Gemini 云基础设施(峰值 AFM)
└─ 你明确点头后,才可能再走 ChatGPT 等第三方
Private Cloud Compute 在这里的角色,是把「请求出了设备」这件事从 信任 Google / OpenAI 的隐私政策,改成 信任苹果自己签过名的隔离环境。即便 GPU 在别人的机房里,苹果仍坚持:无持久存储、不用于训练、硬件与软件栈由苹果定义。这套说法能不能被独立研究者持续验证,会是 2026 下半年真正的舆论战场——比「Siri 用了谁的模型」更值得盯。
一条时间线,对齐预期
| 时间 | 事件 | 对用户的含义 |
|---|---|---|
| 2024-06 | WWDC:Apple Intelligence + ChatGPT 可选 | 系统开始有生成式功能,Siri 大改尚未兑现 |
| 2025 | 新 Siri 公开延期到 2026 | 广告与交付脱节,压力转移到 2026 |
| 2025 下半年 | 媒体:苹果与 Google 谈定制 Gemini | 底座外购的路径被市场定价 |
| 2026-01-12 | Apple–Google 联合声明 | 合同落地:AFM based on Gemini |
| 2026-06 | WWDC:下一代 Apple Intelligence、Siri AI | 开发者可测;用户仍要等 Beta |
| 2026 秋 / 年末 | 系统功能随新 OS 推送;Siri AI 英文 Beta | 「能用」和「好用」会差一个版本 |
如果你在等「Siri 一夜之间变成 ChatGPT」,大概率会失望。更现实的路径是:先变聪明一点、先在英文里变得可对话、再慢慢学会跨 App 办事。 真正的产品风险不在联名新闻稿,而在延迟、幻觉、以及「本机上下文」和「云端推理」之间那一次路由有没有选错。
对开发者和 Mac 工作流意味着什么
对做 App 的人,这条合作改变的是 系统助理的能力上限,不是你的本地工具链。
- App Intent / 新 Siri 动作。 若 Siri AI 真能「在 App 里办事」,2026 年最值得补的不是再包一层聊天 UI,而是把核心流程暴露成可被系统调用的 Intent。测试需要真机或完整 macOS 27 环境,而不是只在浏览器里 mock。
- 设备端模型没有过时。 Core ML、MLX、Neural Engine 仍然是低延迟、零 API 账单的路径。Gemini 进的是苹果云端上限,不是把 16GB Mac mini 上的本地推理作废。
- 别把排期押在 Siri Beta 上。 英文用户 Beta、欧盟限制、中国大陆监管,都会让「全员都能用新 Siri」比新闻稿更晚。内部工具、CI、Agent 工作流,该继续用 Claude Code、Cursor、本地 Ollama,而不是等系统助理来写代码。
- 需要一台一直在线的 Mac 时。 编译 iOS、跑 Xcode Cloud 替代方案、验证 App Intent、同时挂着本机模型和远程 Agent,用 Cloud Mac / Mac mini 云主机 比把办公笔记本 24 小时开着更干净。
相关背景可以对照站内已经写过的分层科普:零基础看懂苹果 AI 芯片:本地算力与云端分工,以及硬件代际:M4 / M5 Apple Silicon 与 AI 平台升级。
常见问题
Siri 是不是已经变成 Google Gemini?
没有。用户面对的仍是 Apple Intelligence 与 Siri AI。Gemini 提供的是下一代 Apple Foundation Models 的底座和部分云能力,不是把 Gemini App 装进 iOS。
那我的对话会不会被 Google 拿去训练?
苹果的公开承诺是:Apple Intelligence 继续在设备与 Private Cloud Compute 上运行,并维持其隐私标准;即便峰值推理使用 Google 云技术,也套用 PCC 同级隔离,且不用于训练对方模型。最终仍以系统设置里的许可提示和苹果法律文本为准。
ChatGPT 还在吗?
联合声明没有宣布关闭与 OpenAI 的集成。更干净的理解是:ChatGPT 仍可能作为「你点头之后」的外部专家;Gemini 底座进入的是系统助理自己的地基。
为什么苹果不自己把最大模型训到够用?
可以,但 2025 年已经证明:系统级 Siri 的交付日期等不起自研最大模型的收敛曲线。外购底座、自有体验,是在「按时交货」和「品牌控制」之间的折中。
开发者现在该做什么?
把关键用户流程做成 App Intent;在 macOS 27 / iOS 27 上测 Siri AI 调用;本地推理继续走 Core ML / MLX。需要稳定的远程 Mac 节点时,用独立的 Cloud Mac,避免和日常电脑抢内存。
ZavCloud Developer Infrastructure
在独立 Mac 节点上测 iOS 27 与 Siri AI
按天租用 M4 Mac mini,跑 Xcode、App Intent 和本机模型,不必把办公本 24 小时开着。
1Gbps 专线,远程桌面与 SSH 同时在线,适合 CI 与 Agent 长任务。