苹果发布会的暗线:Siri不再只等提问,开始借硬件“看、听、说。9月10日凌晨的苹果发布会,首款折叠手机抢走了多数注意力,但把新品放在一起看,更值得关注的是Siri AI的感知能力补全。
今年6月Siri升级为Siri AI后,苹果正在用不同硬件给它加装现实世界的输入通道。按发布会信息,iPhone承担视觉感知:Siri AI可结合邮件、照片、信息理解个人上下文,也能读取屏幕内容,并调用不同App执行操作。
相机新增专门的Siri模式,对准物体拍摄后,可直接回答眼前问题并采取行动。Apple Watch负责声音感知,新增的Audio Intelligence包含声音识别,可提示警报、门铃、婴儿哭声等;
对话转文字和谈话摘要功能,则把过去15秒的语音变成可追问的文字记录。AirPods成为语音入口,支持免提调用Siri,结合个人信息和外部知识作答。跨设备的Siri App通过iCloud实现对话续接,让同一任务不在切换设备时中断。
这条暗线的逻辑清晰:大模型能力之外,AI要办事,先得感知环境。手机看、手表听、耳机说,正好覆盖视觉、听觉和语音交互三个入口。相比单独升级语音助手,这种硬件矩阵式补感知,更接近“环境代理”的雏形。
但演示流畅不等于日常可靠。个人上下文、屏幕理解和持续收音,都涉及隐私边界与数据授权。跨设备续聊依赖苹果生态闭环,一旦离开自家硬件,体验可能断裂。
更关键的是,感知能力越强,误识别和误操作的代价越高。苹果能否把演示中的顺滑转化为稳定、可信任的日常工具,才是这条暗线真正的考验。
