本文呈现的是 2026 年 2 月 15 日、在苹果尚未确认 WWDC 计划之前,能够合理作出的判断。当时多方报道正逐渐指向同一件事:一个能力大幅增强的 Siri,具备更自然的对话、更强的屏幕内容感知,以及对个人上下文更充分的利用。
到 2026 年初,Siri 的困境既是技术上的,也同样是口碑上的。苹果在 2011 年 10 月随 iPhone 4S 推出了它,远早于亚马逊和谷歌把各自的助理摆到消费者面前;有那么一段时间,是它定义了人们对「手机能听懂什么」的期待。此后便是漫长的原地踏步。Siri 在定时器、拨电话和单位换算上一直够用,但凡需要记住上一句话的场景,它就一直很脆弱。
在那个阶段,重要的是方向,而不是确定性。各家传闻报道在时间表和技术架构上说法不一,而苹果从未公开确认过由 Gemini 驱动的 Siri、已经敲定的授权协议,或任何具名的第三方助理框架。
报道中的那份谨慎,有一部分是有来由的。苹果自己在上一个产品周期中就承认过,它演示过的那个更懂个人、更懂上下文的 Siri 所需的时间超出了原计划——对于一家宁愿让未发布功能悄悄消失的公司来说,这是异常直白的表态。因此,2026 年 2 月的任何一篇报道,面对的都是一群已经被许诺过一次类似东西的读者。
贯穿所有报道的最强主线,是苹果一贯的优先级:比大多数消费级 AI 服务更紧密的产品整合,以及更严格的隐私控制。这意味着这次 Siri 升级会优先围绕苹果设备来设计,而不是把一个通用聊天机器人硬拴到生态系统上。
被提及最多的两项能力——屏幕内容感知与个人上下文的运用——在工程上都比一副更流利的嗓子难得多。它们要求助理持有一份关于用户邮件、消息、照片和应用数据的可检索图景,能把一个代词对应到屏幕上恰好显示的内容,然后再通过应用自身开放的接口去执行操作。苹果多年来一直在为此铺设开发者层面的管线,从 SiriKit 到 App Intents,而第三方应用的采用率始终是瓶颈所在。
隐私问题同样不是修辞。按苹果公开阐述的设计,能在设备自有芯片上运行的部分就在本地运行,其余交给它所描述的专门打造、可接受独立核查的服务器——而一旦引入外部模型,这套结构就明显更难解释了。被授权的模型究竟是运行在这道边界之内、被蒸馏成苹果自己交付的东西,还是像今天可选的第三方聊天机器人那样被调用,恰恰是当时的报道无法定论的部分。
门槛的抬高,也有苹果无法控制的原因。几年下来,聊天式界面已经让人们习惯了追问、在对话中途纠正,以及长于一句话的回答;而现实中语音助理的使用场景却顽固地狭窄:定时器、音乐、天气、打电话。所谓「更善于对话」,如果想让用户真正察觉到升级,就必须意味着弥合这道落差。用更好听的嗓音复述同样那份简短的任务清单,是做不到的。
如果那些报道站得住脚,真正的跃迁与其说在于营销措辞,不如说在于实用性。一个能理解屏幕上的内容、能在多次请求之间保持连续性、并能调用更多个人上下文的 Siri,将实质性地超越一次性的语音指令。
无论如何,借助外部力量在苹果这里并非没有先例。长期以来,苹果一直乐于租用另一家公司的技术,再套上自己的界面,其中最显眼的就是搜索:其设备上的默认搜索引擎属于别人,而商业条款是苹果不会公开谈论的内容。报道中所描述的那类模型授权,不寻常之处在于规模,而不在于性质。
对读者而言,可以得出的实际结论很有限。传闻周期不是购买硬件的好依据;而苹果近来的做法,是把大型软件功能分散到整个发布周期中逐步推出,而不是在第一天全部交付,可用性还会因语言和地区而异。2 月里有用的自律,是把可证伪的说法——日期、设备要求、具名合作方——与氛围性的描述区分开来,然后等待前者接受公开检验。
读者应把这篇文章当作 2026 年 2 月 15 日 WWDC 前报道的一份快照。真正的验证节点是苹果 2026 年 6 月 8 日的 WWDC 主题演讲,它随后把传闻时期的说法与正式公布的功能区分了开来。