苹果 Siri 首次嵌入 Gemini,端云混合重构 AI 助手
2026 年 6 月 9 日,蒂姆·库克最后一次以 CEO 身份站在 WWDC 舞台上,交出了一份标志性的告别答卷——全新 Siri AI。但比「库克最后一舞」更引人注目的,是苹果首次打破封闭生态,将 Google Gemini 的能力嵌入到 Apple Intelligence 的核心架构中。
Gemini 入局:苹果的端云混合新架构
苹果在 WWDC26 上公开了一个出人意料的合作:与 Google 深入合作,引入 Gemini 系列模型背后的技术,联合打造新一代 Apple 基础模型。这不是简单的 API 调用或「Siri 帮你搜 Google」——Gemini 的推理与多模态能力被直接整合进 Apple 智能的底层模型栈。
新架构采用端云双层设计。第一层是升级后的设备端模型(第二版),利用 Apple Silicon 的神经网络引擎,支持语音理解与生成、文本理解和图像识别,所有处理均在本地完成。第二层是基于专用云计算的服务器端模型,通过苹果的 Private Cloud Compute 基础设施运行,负责处理需要更强算力的复杂推理任务。
连接两层的是一个全新的「系统协调器」(System Orchestrator)。它不只是一个路由器——它能感知当前任务的计算复杂度、隐私敏感度和延迟要求,实时决策由端侧模型处理还是上云调用 Gemini 能力。简单来说:问天气、设闹钟走端侧;分析文档、多步推理、图像生成走云端。
Siri AI:从语音助手到跨平台智能体
Siri AI 是这次升级中最直观的产物。它不再是那个「我好像不明白」的语音助手。
在功能层面,Siri AI 获得了四项核心能力:个人情境理解(跨邮件、照片、日历等私有数据)、App 操作(可调用各 App 的工具箱完成复杂任务)、屏幕感知(实时理解当前屏幕上显示的内容)和视觉智能(通过相机识别物体、场景并执行相关操作)。
产品形态上,苹果为 Siri AI 做了三件事:其一,推出独立的 Siri App,支持跨设备无缝流转对话——iPhone 上开始、iPad 上继续、Mac 上收尾;其二,视觉智能被深度整合进相机和操作系统,对准食物能分析营养成分,注视屏幕内容能直接提问;其三,写作工具升级为全系统可用,既能在任何 App 中生成初稿,也能沿袭用户的沟通风格撰写信息。
在交互形式上,Siri 不再只是灵动岛上的小球。从灵动岛向下轻扫即可进入搜索,支持打字对话。在 Mac 上,按住 Control 点选文件、图片或文本就能呼出 Siri 提问。Siri AI 的对话能力覆盖了 iOS、iPadOS、macOS、watchOS 和 visionOS 全部五大平台。
产品战略意义:封闭生态的开放式进化
苹果与 Google 的合作放在几年前几乎是不可想象的。两家公司曾在移动操作系统、地图、浏览器等战场上针锋相对。但 AI 时代的竞争逻辑变了——用户需要的不是「谁家的模型更强」,而是「谁能无缝调用最强的模型」。
苹果的选择很务实。它没有放弃自研模型(设备端模型和专用云计算框架仍是苹果控制),而是在云端推理层引入最强的外部能力。这种「端侧苹果+云端 Gemini」的混合范式,既保住了隐私和体验控制权,又迅速弥补了 Siri 在大模型能力上的代差。
这也意味着 AI 助手的竞争正从单一模型 PK 走向操作系统级的「模型编排」。谁能更好地调度端侧、云端、第三方模型资源,为用户提供无感的最优体验,谁就能在下一个十年占据主动权。苹果用 Siri AI 和系统协调器给出了自己的答案。
不过,苹果同时确认,受监管审批进程影响,Siri AI 及 Apple 智能新功能在中国大陆市场暂不提供。这也意味着端云混合架构在不同地区的落地节奏将深度绑定当地政策环境,为这一产品的全球化带来了更多变量。