苹果发布文档说明Siri新音频功能如何在保护隐私的前提下实现“环境聆听”
苹果声称Audio Intelligence的原始音频仅在S11芯片的Secure Exclave中处理,不保存为文件,苹果、操作系统和应用均无法访问。
AI解读:苹果在周三的iPhone Duo发布会上推出了一批新的Siri AI音频功能,包括Siri Recap、Live Rewind、Sound Recognition和Music Recognition。这些功能依赖手表麦克风持续“环境聆听”,自然让用户担心隐私,所以苹果专门发了一份文档来解释数据怎么隔离。
核心设计是硬件隔离:音频进入Apple Watch S11芯片里的Secure Exclave,一个独立的安全分区,watchOS、应用、用户甚至苹果自己都无法读取其中的处理数据。原始音频不转录、不存储,只在缓冲区里不断覆盖写入,根本不会形成录音文件。
另外,Live Rewind每次都要双击数码表冠才激活,算是把主动权交回给用户。如果数据要传到iPhone,也是通过两端Secure Exclave加密传输;用户自己决定保留哪些文本,开了密码和iCloud双重认证后文本会端到端加密。
这套方案的价值在于把隐私承诺变成芯片级硬约束——不是靠公司自律或软件权限,而是让第三方在物理上拿不到原始音频。对关心隐私的Apple Watch用户来说,这就是个能讲清“谁能碰你的声音”的技术答案。
苹果在周三的iPhone Duo发布会上公布了一批新的Siri AI Audio Intelligence功能,包括Siri Recap、Live Rewind、Sound Recognition和Music Recognition。与此同时,苹果发布了一份文档,说明自己打算如何在AI“环境聆听”与用户隐私之间取得平衡。苹果称,这些新功能产生的原始音频“在专用硬件中处理,不会保存为文件,操作系统、应用或苹果公司都无法访问”。
Secure Exclave硬件隔离方案
苹果解释称,Audio Intelligence依赖的是为新款Apple Watch Series 12和Apple Watch Ultra 4提供支持的S11芯片中的Secure Exclave。Secure Exclave是硅片上内置的一个硬件隔离区,用于独立于系统其余部分处理传感器数据。在Secure Exclave中处理和分析的数据,watchOS、应用、用户或苹果公司都无法访问。
麦克风采集的音频进入Apple Watch的Secure Exclave后,会在不转录、不存储原始音频的情况下进行语音、声音或音乐的初步处理。这一缓冲区是一条不断被覆盖写入的数据流,只存在于受保护硬件内部,从不生成音频录音。
用户控制与传输加密
苹果还表示,用户能控制Audio Intelligence功能“是否以及何时”处于活动状态——Live Rewind每次都需要用户双击数码表冠才能启用。如果Audio Intelligence数据需要传到iPhone,会通过两台设备的Secure Exclave进行加密传输。用户还可以自行决定保留Siri Recap和Live Rewind中的哪些文本;如果设备设置了密码并启用了iCloud双重认证,Audio Intelligence生成的文本将以端到端加密方式同步。