Siri AI:苹果的「延迟交付」如何重构操作系统级AI
一、迟到的Siri,操作系统级的重构
北京时间2026年6月9日,苹果在库克主持的最后一场WWDC上,用了75分钟中的70%时间谈论AI。这场被外界称为「库克谢幕之作」的开发者大会,最重要的信息藏在开场不久的一句话里:那个多次跳票的Siri,这次真的来了。
苹果给它起了一个新名字——Siri AI,这不是简单的版本升级,而是一次操作系统级别的重构。过去那个只能放歌、查天气的「语音遥控器」,正在进化成集成在iOS、iPadOS、macOS深处的Agent。
演示中,主持人打开一张随手拍的照片,Siri AI瞬间识别出位置,自动在地图上导航,接着从社交软件中提取朋友发过的地址,规划出中途拜访路线——完成查看屏幕、提取信息、调用应用的完整闭环。这标志着AI第一次真正成为应用之上的入口,而不仅仅是应用内的功能。
另一个演示更令人印象深刻:用户让Siri查询世界杯赛程,并提出举办巴西对摩洛哥观赛派对的设想。Siri随即检索全球知识库,翻出好友聊天记录中提到的特色食谱,整合出一份两国风味菜单,并起草群发邀请一键发送。全程无需任何手动操作,系统级AI的威力尽显。
二、五项AI能力:智能助手的本质跃迁
新的Siri AI具备五项核心能力:个人情境理解、图像理解、世界知识、屏幕感知以及应用调用。这五项能力组合,实现了从被动响应到主动服务的质变。
个人情境理解让Siri能调用设备上的所有信息——文字、图片、邮件、日历,形成对用户的深度认知。这解决了过去AI「不了解你」的根本问题。
图像理解让Siri「看」得见。镜头对准一盘菜,它能估算卡路里;面对一张账单,它能算出每人应付金额。相机不再只是记录工具,而是AI的「眼睛」。
世界知识是苹果几年前就开始构建的知识图谱,现在与AI大模型结合,形成了常识+专业知识的双重保障机制。
屏幕感知是最具颠覆性的能力之一。Siri能「看」到手机屏幕并「理解」内容,这意味着AI可以基于你当前正在做的事情提供服务,而不是等待你主动提问。
应用调用则是真正的「手替」。Siri不再只是回答问题,而是能替你操作应用——整理相册、安排日程、回复邮件,完成从认知到执行的完整闭环。
这五项能力的组合,让Siri从一个工具进化成了伙伴。用苹果的话说,这是「以你为中心的AI」。
三、系统编排器:苹果AI的四重架构
Siri AI惊艳表现的背后,是苹果对整个AI架构的系统性重构。核心是一个叫做System Orchestrator(系统编排器)的架构。
在智能体时代,AI执行任务不再是单个大模型回答所有问题,而是多个小模型、工具、端云任务、上下文记忆的协同作战。Orchestrator的任务就是将整体任务拆解成合适的大小,分配到最适合执行的部分。
苹果的System Orchestrator调度四大功能模块:
个人信息理解模块负责处理设备上的本地信息——你的聊天记录、相册、日程、邮件,所有敏感数据都在本地处理。
世界知识模块提供常识和最新信息,当本地知识不足时,AI能到云端寻找合适的信息补充。
Actions模块是用户的「手替」,让Siri真正执行操作,而不是停留在对话层面。
屏幕感知模块是用户的「眼替」,能读取屏幕信息作为AI的输入源。
这四个模块两两组合:内部信息与外部知识结合,执行输出与信息输入结合,形成了完整的AI服务闭环。
四、从Apple Intelligence到Gemini Intelligence
最值得关注的是,支撑这套系统的AI大模型,是基于谷歌Gemini而非苹果自研的。这是苹果AI战略的一个重要转折。
2024年WWDC,苹果高调推出Apple Intelligence,承诺最「苹果」的体验、最好的AI大模型协同、最顺畅的端云联动。两年后的今天,一切尘埃落定——Apple Intelligence是基于谷歌Gemini共同打造的。
苹果的基础模型Apple Foundation Models分为端侧和云端两个版本:
端侧方面,所有支持Apple Intelligence的设备都带一个约3B大小的基础模型。在性能更好的设备上(最新款iPhone、Mac),苹果额外搭载一个更大的模型,提供更高质量的输出和更长的上下文。同时还有一个独立的语音模型,用于Siri的自然对话和个性化语音合成。
云端方面,苹果搭建了Private Cloud Compute(PCC)基础设施,但有一个反常识的设计:云端处理完用户需求就「删除」数据,苹果不掌握也看不到用户数据。
这种设计在AI行业颇为罕见——大模型厂商通常都非常重视交互数据,用于持续迭代模型能力。苹果的做法更像是执行复杂需求的「一锤子买卖」,侧面说明苹果可能尚未建立完善的数据闭环和独立训练能力。
五、多设备体验:Siri的形态革命
Siri AI的体验也因设备而异,体现了苹果的生态优势:
在iPhone上,Siri被嵌入灵动岛,向下轻扫就能进行语音或文字多轮对话。专属的Siri App让所有对话记录通过iCloud私密同步。
在Mac上,Siri被整合进Spotlight,可以在任意界面呼出,通过右键菜单针对选中内容提问。
Apple Watch上,Siri AI以极简的交互直接在手腕上执行操作。
Vision Pro上更进一步——只需注视Siri并开口说话,无需任何唤醒词,实现真正的自然交互。
这种多设备一致性,让「在iPhone上开始的对话,可以在iPad上接续,在Mac上收尾」成为现实,这是其他AI助手难以复制的生态护城河。
六、苹果的「拧巴」与突破
仔细审视苹果的AI布局,依然能感受到某种「拧巴」:
一方面,世界知识模块沿用了几年前的知识图谱,在大模型都能联网的今天显得有些冗余。另一方面,应用调用能力目前主要针对苹果原生应用,在第三方应用协同方面,甚至比不上国内AI手机「一句话点咖啡」的自由度。
但苹果最大的突破在于:承认AI慢了,并且做出了务实的选择。
与谷歌Gemini的合作,对于「困在自研执念」的苹果是一次重要跨越。在中国手机厂商不断炫技的2026年,苹果终于明白交付大于完成的道理。
更重要的是,苹果将AI重构到了操作系统层面。这不是在应用里加个AI功能,而是让AI成为系统的核心构成。这种深度的系统集成,让Siri AI具备了其他AI助手难以企及的权限和能力。
七、中国用户的等待与可能
苹果AI的更新计划显示:支持最老到iPhone 11,PC必须是苹果芯片,但中国和欧盟暂时无法使用。
这背后是数据合规的现实考量。此前,苹果计划与百度合作,将文心一言作为国行iPhone生成式AI底层,后又与阿里接触适配国内合规要求。在无法直接使用谷歌服务的情况下,千问或文心等国产大模型很可能成为新的本土大脑。
这件事能否成功、进展快慢,直接决定了中国用户能否用上全新的Siri。
抛开区域限制,这次WWDC真正值得记住的是:苹果完成了AI时代的重构,并将Agent植入到操作系统。这不仅仅是Siri的升级,而是整个苹果生态向AI原生进化的开端。
八、未来:操作系统级AI的想象空间
Siri AI的发布只是一个开始。操作系统级AI的最大想象空间在于:
它将重新定义人机交互的边界。过去,我们通过触摸、语音、手势与设备互动;未来,AI将成为隐形的桥梁,理解我们的意图,主动提供服务。
它将重构应用生态。当AI能直接调用应用功能时,应用本身的界面价值可能减弱,API和功能模块的价值将凸显。
它将催生新的商业模式。操作系统级AI可能成为新的分发渠道、新的服务入口、新的变现方式。
苹果花了两年时间,终于交付了Siri AI。虽然有些「拧巴」,虽然需要与谷歌合作,虽然中国用户还要等待——但这次WWDC证明了一件事:在AI的竞技场上,苹果依然是那个能够完成系统性重构的选手。
库克的谢幕,Siri的起航,苹果AI的故事,才刚刚开始。
特别声明:产联社摘录或转载的属于第三方的信息,目的在于传递更多信息而非盈利,同时并不代表赞成其观点或证实其描述,内容仅供参考。转载信息版权归原媒体及作者所有,若有侵权,请联系我们删除。如其他媒体、网站或个人擅自转载使用,请自负版权等法律责任。



