Siri AI:苹果的「延迟交付」如何重构操作系统级AI

https://assets.wanlianyida.com/industry-uniapp/web/static/image-default.BtYt8t8Z.png
具身材料观察
·阅读量:4,087

一、迟到的Siri,操作系统级的重构

北京时间2026年6月9日,苹果在库克主持的最后一场WWDC上,用了75分钟中的70%时间谈论AI。这场被外界称为「库克谢幕之作」的开发者大会,最重要的信息藏在开场不久的一句话里:那个多次跳票的Siri,这次真的来了。

苹果给它起了一个新名字——Siri AI,这不是简单的版本升级,而是一次操作系统级别的重构。过去那个只能放歌、查天气的「语音遥控器」,正在进化成集成在iOS、iPadOS、macOS深处的Agent。

演示中,主持人打开一张随手拍的照片,Siri AI瞬间识别出位置,自动在地图上导航,接着从社交软件中提取朋友发过的地址,规划出中途拜访路线——完成查看屏幕、提取信息、调用应用的完整闭环。这标志着AI第一次真正成为应用之上的入口,而不仅仅是应用内的功能。

另一个演示更令人印象深刻:用户让Siri查询世界杯赛程,并提出举办巴西对摩洛哥观赛派对的设想。Siri随即检索全球知识库,翻出好友聊天记录中提到的特色食谱,整合出一份两国风味菜单,并起草群发邀请一键发送。全程无需任何手动操作,系统级AI的威力尽显。

二、五项AI能力:智能助手的本质跃迁

新的Siri AI具备五项核心能力:个人情境理解、图像理解、世界知识、屏幕感知以及应用调用。这五项能力组合,实现了从被动响应到主动服务的质变。

个人情境理解让Siri能调用设备上的所有信息——文字、图片、邮件、日历,形成对用户的深度认知。这解决了过去AI「不了解你」的根本问题。

图像理解让Siri「看」得见。镜头对准一盘菜,它能估算卡路里;面对一张账单,它能算出每人应付金额。相机不再只是记录工具,而是AI的「眼睛」。

世界知识是苹果几年前就开始构建的知识图谱,现在与AI大模型结合,形成了常识+专业知识的双重保障机制。

屏幕感知是最具颠覆性的能力之一。Siri能「看」到手机屏幕并「理解」内容,这意味着AI可以基于你当前正在做的事情提供服务,而不是等待你主动提问。

应用调用则是真正的「手替」。Siri不再只是回答问题,而是能替你操作应用——整理相册、安排日程、回复邮件,完成从认知到执行的完整闭环。

这五项能力的组合,让Siri从一个工具进化成了伙伴。用苹果的话说,这是「以你为中心的AI」。

三、系统编排器:苹果AI的四重架构

Siri AI惊艳表现的背后,是苹果对整个AI架构的系统性重构。核心是一个叫做System Orchestrator(系统编排器)的架构。

在智能体时代,AI执行任务不再是单个大模型回答所有问题,而是多个小模型、工具、端云任务、上下文记忆的协同作战。Orchestrator的任务就是将整体任务拆解成合适的大小,分配到最适合执行的部分。

苹果的System Orchestrator调度四大功能模块:

个人信息理解模块负责处理设备上的本地信息——你的聊天记录、相册、日程、邮件,所有敏感数据都在本地处理。

世界知识模块提供常识和最新信息,当本地知识不足时,AI能到云端寻找合适的信息补充。

Actions模块是用户的「手替」,让Siri真正执行操作,而不是停留在对话层面。

屏幕感知模块是用户的「眼替」,能读取屏幕信息作为AI的输入源。

这四个模块两两组合:内部信息与外部知识结合,执行输出与信息输入结合,形成了完整的AI服务闭环。

四、从Apple Intelligence到Gemini Intelligence

最值得关注的是,支撑这套系统的AI大模型,是基于谷歌Gemini而非苹果自研的。这是苹果AI战略的一个重要转折。

2024年WWDC,苹果高调推出Apple Intelligence,承诺最「苹果」的体验、最好的AI大模型协同、最顺畅的端云联动。两年后的今天,一切尘埃落定——Apple Intelligence是基于谷歌Gemini共同打造的。

苹果的基础模型Apple Foundation Models分为端侧和云端两个版本:

端侧方面,所有支持Apple Intelligence的设备都带一个约3B大小的基础模型。在性能更好的设备上(最新款iPhone、Mac),苹果额外搭载一个更大的模型,提供更高质量的输出和更长的上下文。同时还有一个独立的语音模型,用于Siri的自然对话和个性化语音合成。

云端方面,苹果搭建了Private Cloud Compute(PCC)基础设施,但有一个反常识的设计:云端处理完用户需求就「删除」数据,苹果不掌握也看不到用户数据。

这种设计在AI行业颇为罕见——大模型厂商通常都非常重视交互数据,用于持续迭代模型能力。苹果的做法更像是执行复杂需求的「一锤子买卖」,侧面说明苹果可能尚未建立完善的数据闭环和独立训练能力。

五、多设备体验:Siri的形态革命

Siri AI的体验也因设备而异,体现了苹果的生态优势:

在iPhone上,Siri被嵌入灵动岛,向下轻扫就能进行语音或文字多轮对话。专属的Siri App让所有对话记录通过iCloud私密同步。

在Mac上,Siri被整合进Spotlight,可以在任意界面呼出,通过右键菜单针对选中内容提问。

Apple Watch上,Siri AI以极简的交互直接在手腕上执行操作。

Vision Pro上更进一步——只需注视Siri并开口说话,无需任何唤醒词,实现真正的自然交互。

这种多设备一致性,让「在iPhone上开始的对话,可以在iPad上接续,在Mac上收尾」成为现实,这是其他AI助手难以复制的生态护城河。

六、苹果的「拧巴」与突破

仔细审视苹果的AI布局,依然能感受到某种「拧巴」:

一方面,世界知识模块沿用了几年前的知识图谱,在大模型都能联网的今天显得有些冗余。另一方面,应用调用能力目前主要针对苹果原生应用,在第三方应用协同方面,甚至比不上国内AI手机「一句话点咖啡」的自由度。

但苹果最大的突破在于:承认AI慢了,并且做出了务实的选择。

与谷歌Gemini的合作,对于「困在自研执念」的苹果是一次重要跨越。在中国手机厂商不断炫技的2026年,苹果终于明白交付大于完成的道理。

更重要的是,苹果将AI重构到了操作系统层面。这不是在应用里加个AI功能,而是让AI成为系统的核心构成。这种深度的系统集成,让Siri AI具备了其他AI助手难以企及的权限和能力。

七、中国用户的等待与可能

苹果AI的更新计划显示:支持最老到iPhone 11,PC必须是苹果芯片,但中国和欧盟暂时无法使用。

这背后是数据合规的现实考量。此前,苹果计划与百度合作,将文心一言作为国行iPhone生成式AI底层,后又与阿里接触适配国内合规要求。在无法直接使用谷歌服务的情况下,千问或文心等国产大模型很可能成为新的本土大脑。

这件事能否成功、进展快慢,直接决定了中国用户能否用上全新的Siri。

抛开区域限制,这次WWDC真正值得记住的是:苹果完成了AI时代的重构,并将Agent植入到操作系统。这不仅仅是Siri的升级,而是整个苹果生态向AI原生进化的开端。

八、未来:操作系统级AI的想象空间

Siri AI的发布只是一个开始。操作系统级AI的最大想象空间在于:

它将重新定义人机交互的边界。过去,我们通过触摸、语音、手势与设备互动;未来,AI将成为隐形的桥梁,理解我们的意图,主动提供服务。

它将重构应用生态。当AI能直接调用应用功能时,应用本身的界面价值可能减弱,API和功能模块的价值将凸显。

它将催生新的商业模式。操作系统级AI可能成为新的分发渠道、新的服务入口、新的变现方式。

苹果花了两年时间,终于交付了Siri AI。虽然有些「拧巴」,虽然需要与谷歌合作,虽然中国用户还要等待——但这次WWDC证明了一件事:在AI的竞技场上,苹果依然是那个能够完成系统性重构的选手。

库克的谢幕,Siri的起航,苹果AI的故事,才刚刚开始。

特别声明:产联社摘录或转载的属于第三方的信息,目的在于传递更多信息而非盈利,同时并不代表赞成其观点或证实其描述,内容仅供参考。转载信息版权归原媒体及作者所有,若有侵权,请联系我们删除。如其他媒体、网站或个人擅自转载使用,请自负版权等法律责任。

80
26
分享
上一篇 下一篇