关于 Apple Watch Series 12 和 Apple Watch Ultra 4 上的音频智能功能

音频智能是一类全新的 Apple 智能功能,它借助 Apple Watch 的麦克风、Apple 芯片的强大算力,结合设备端与云端 AI 模型,协助你检测声音、识别音乐,让你专注当下、不错过重要提示,每一步都充分保护你的隐私。音频智能包括声音识别、Shazam 自动音乐识别、Live Rewind 和 Siri Recap。

Live Rewind 和 Siri Recap 功能将于今年晚些时候以 Beta 版形式推出,最初仅支持英语。更多详情将在正式发布时公布。

音频智能功能的作用

Apple Watch 上的音频智能依托硬件、软件与最新 AI 模型三者的紧密集成,可提供四项全新功能。

声音识别

Apple Watch 上显示“声音识别”。

声音识别功能可检测警笛、警报器和门铃等重要声音,并向你发送通知,即使你的 iPhone 不在身边也不受影响。这项功能对失聪或听障人士格外实用。

音乐识别

Apple Watch 上显示“音乐识别”。

Shazam 音乐识别功能可自动检测背景中正在播放的歌曲,并直接在智能叠放中显示歌曲名称与演唱者信息,全程无需轻点小组件。

Live Rewind

Apple Watch 上显示“Live Rewind”。

Live Rewind1 功能支持你连按两下数码表冠,即可在 Apple Watch 上查看最近 15 秒对话的文字片段,轻松补全漏听或没听清的内容。你可向 Siri 询问这个片段的内容,也可直接将其存储到 Siri App 中。

Siri Recap

Apple Watch 上显示“Siri Recap”。

Siri Recap1 会会在后台静默记录你全天的对话内容,生成由 Apple 智能提炼的重点摘要,方便你后续唤起记忆,让你全程专注于当下。如果你选择不存储,这些摘要将在 7 天后自动删除。

一切由你掌控

每项音频智能功能都需你主动启用才能使用。对于 Live Rewind 和 Siri Recap,你可以自行决定在何时何地启用这两项功能。

  • 声音识别可通过 iPhone 的“设置”App 启用。在 iPhone 上打开“设置”App,依次轻点“辅助功能”、“声音与姓名识别”、“声音识别”,然后打开“使用 Apple Watch 检测”。如果你已在 iPhone 上启用“声音识别”,它就会自动在你的 Apple Watch 上启用。

  • Shazam 可在 Apple Watch 的“设置”App 中打开。在 Apple Watch 上打开“设置”App,轻点“智能叠放”,然后打开“音乐检测”(或者在智能叠放中出现“启用音乐检测”小组件时轻点它)。如果你已在 Apple Watch 上启用“音乐检测”,则无需再次启用。

  • Live Rewind 仅在你特意连按两下数码表冠时才会激活。它只会在显示屏上以文字片段的形式显示最近 15 秒的语音内容,不会在后台持续转录,也不会存储文本,除非你选择向 Siri 询问相关内容或将文本存储到 Siri App 中。你可以通过 iPhone 上的 Watch App 打开这项功能 — 只需打开 Watch App,依次轻点“Siri”、“Live Rewind”,然后打开“连按两下数码表冠”。

  • Siri Recap 只有当你选择启用时才会运行。你可以在 iPhone 上的 Watch App 中打开 Siri Recap。开启后,你可根据时间和/或地点(例如“仅在工作时”或“夜间从不”)设置运行计划,也可手动开关。无论选择哪种方式,你都可以随时从“控制中心”打开或关闭这项功能。

  • 你的数据始终由你掌控。你可以随时在 Siri App 中查看、编辑和删除你的 Siri Recap 摘要,包括你选择存储的任何 Live Rewind 文字片段。删除任意一条,所有已同步设备中的对应内容都会被移除。此外,你还可以将摘要和文字片段导出到其他 App,包括“备忘录”、“手记”等。

  • 只有你可以访问自己的摘要。存储在 Siri App 中的 Siri Recap 摘要和已存储的 Live Rewind 文字片段,在通过 iCloud 同步时会进行端到端加密,因此只有你自己才能访问,且仅能在受信任的设备上访问。

音频智能功能如何保护你的隐私

iPhone 和 Apple Watch 上显示了“Siri Recap”。

与我们的所有产品和功能一样,Apple Watch 上的音频智能从设计之初就致力于保护你的隐私。

  • 系统不会录制或存储音频。音频智能功能不会创建音频录音。操作系统、App、你本人,甚至 Apple,都无法访问任何音频内容。由于不存在录音,因此无论任何一方提出要求,我们都没有录音可供共享、转发或生成。

  • 原始音频永远无法访问。音频会流入 S11 芯片的 Secure Exclave 内受保护的缓冲区。Secure Exclave 是内置于 Apple Watch 和 iPhone 芯片中的硬件隔离区域,可独立于系统其余部分处理传感器数据。在 Secure Exclave 中处理和分析的数据,操作系统、App、你本人,甚至 Apple,都无法访问。这些数据一经处理,便会立即删除。

  • Siri Recap 和 Live Rewind 旨在帮你唤起记忆,而不是提供详细记录。Siri Recap 不会生成完整的逐字转录文本,只会生成简短的重点摘要,就像你在对话结束后随手记下的笔记。Live Rewind 会显示最近 15 秒内对话内容的文字片段,帮你补全刚才漏听的内容。

  • 你的数据不会被 Apple 访问。对于 Siri Recap,运行在专用云计算 (PCC) 上的 Apple 基础模型,会完成最终输出内容的汇总与规整格式化。PCC 中的数据绝不会被存储,Apple 或任何其他方均无法访问。这些数据仅用于满足你的请求,独立安全专家可随时验证这一承诺。

  • 如果你不采取任何操作,你的数据将自动删除。如果你不存储或导出,Siri Recap 摘要将在 7 天后自动删除。除非你将 Live Rewind 显示的 15 秒文字片段存储到 Siri App,或轻点“询问 Siri”,否则这些片段会在 Apple Watch 显示屏变暗约 30 秒后从 Apple Watch 上永久消失。

  • 你的数据通过 iCloud 以端到端加密方式同步。如果你将 iCloud 与双重认证搭配使用,并且设置了设备密码,那么你选择存储的任何 Siri Recap 摘要或 Live Rewind 文字片段,都会在 Siri App 中以端到端加密的方式同步到你的各台设备。只有你自己才能访问这些信息,且仅限于已登录 iCloud 的设备。Apple 不持有加密密钥。除了你自己之外,包括 Apple 在内的任何人都无法访问你在 Siri App 中存储的端到端加密数据。

音频智能功能如何保护周围人的隐私

这些功能不仅旨在保护你的隐私,也保护周围人的隐私。

  • 不标注说话人。音频智能功能在设计上不会识别或标注说话人。Siri Recap 可能会包含对话中提到的姓名,但不会直接标注说话人(例如,“John 说……”,或标记为“发言者 A”与“发言者 B”)。同样,Live Rewind 可能会逐字转录某人所说的内容,但不会将引述内容标注到具体说话人。

  • Live Rewind 的声音与视觉提示。激活后,即使 Apple Watch 处于静音模式或已连接耳机,也会通过 Apple Watch 的扬声器发出提示音。显示屏上会显示全屏动画和麦克风指示器,并且需要执行明确的连按两下手势才能激活 Live Rewind。这是为了提醒附近的人:这项功能已被激活。

  • 省略的内容。Siri Recaps 会自动过滤省略潜在有害内容,例如宣扬自残、仇恨言论的表述,以及财务数据、政府签发的身份标识、认证数据和特定个人识别信息这类敏感内容。

  • 留意周围的人。虽然音频不会被录音或存储,且不会标注说话人,但如果周围可能有人正在进行私密或敏感对话,请务必留意。

音频智能如何处理你的数据

隐私保护从芯片层面就融入 Apple Watch 的设计之中,硬件与软件无缝配合。虽然不同的音频智能功能对数据的处理方式各不相同,但有一点始终一致:Apple 永远无法访问你的任何数据。

  • 音频在硬件层面受到保护。这四项功能均由 Apple Watch 全新的 S11 芯片及其 Secure Exclave 实现。Secure Exclave 是一个专用的安全缓冲区域,能在受保护的独立环境中私密处理音频,任何人均无法访问,甚至连 Apple 也不例外。

  • Shazam 仅共享声学签名。如果你在 Apple Watch 上打开智能叠放,并且已检测到音乐,Secure Exclave 会在安全缓冲区中处理音频,生成对应歌曲的声学签名(即一种无法还原为原始音频的精简表征形式)。随后,这一签名(而非原始音频)会被发送至 Shazam 服务器,用于识别歌曲。

  • 声音识别和 Live Rewind 均在设备端进行处理。 包括语音识别在内的所有处理过程均在你的 Apple Watch 和 iPhone 上完成。如果你选择向 Siri 询问 Live Rewind 文字片段的内容,或将其存储到 Siri App 中,这些内容会被安全地发送到专用云计算。

  • Siri Recap 使用专用云计算。Apple Watch 上的 Secure Exclave 会对检测到的音频进行加密,并将其传输到配对 iPhone 上的 Secure Exclave。随后,加密音频会在 iPhone 的 Secure Exclave 中进行解密、转录和压缩。为生成摘要,Siri Recap 会将 iPhone 上对话记录的加密精简版本发送到专用云计算。这段精简文本的长度不到原始对话记录的一半,能够提炼出对话的核心内容。系统会移除表露对话语气的内容、非必要语句、填充词和重复表达,完整保留对话中涉及的所有核心讨论主题。这段精简文本会连同一些上下文信息一起发送到 PCC,以生成摘要。最终生成的文本摘要会经过加密,并从专用云计算发送回 iPhone 和 Apple Watch。

  • 通过 iCloud 实现端到端加密同步。Siri Recap 摘要和已存储的 Live Rewind 文字片段将实时保留在 Siri App 的“Recaps”标签页中,并通过 iCloud 同步实现端到端加密。

  • 所有操作均在 Apple 的硬件与软件架构内完成。音频智能功能采用紧密集成的架构设计,你的数据仅在设备端及专用云计算环境中处理。

需要满足的条件

声音识别和 Shazam 自动音乐识别

  • Apple Watch Series 12、Apple Watch Ultra 4

  • iPhone 11 或后续机型,或运行 iOS 27 的 iPhone SE(第 2 代或后续机型)

Live Rewind 和 Siri Recap

这两项功能将于今年晚些时候以 Beta 版形式推出。

  • Apple Watch Series 12、Apple Watch Ultra 4

  • iPhone 16、iPhone 16 Plus、iPhone 16 Pro、iPhone 16 Pro Max、iPhone 17、iPhone 17e、iPhone 17 Pro、iPhone 17 Pro Max、iPhone Air、iPhone 18 Pro、iPhone 18 Pro Max 或 iPhone Duo

  • 需要 Apple 智能和 Siri AI(Beta 版)2

  • Live Rewind 和 Siri Recap 不面向 13 周岁以下用户提供。对于使用儿童账户且未满 18 周岁的用户,Live Rewind 和 Siri Recap 必须由家长或监护人开启。

  • 目前仅支持英语,更多语言将陆续推出

进一步了解

  1. Siri Recap 摘要和 Live Rewind 文字片段使用 Apple 智能生成,可能不完整或不准确。重要细节可能会被遗漏、误解或概括错误。当准确性至关重要时,请向相关人员或其他可靠来源核实重要信息。Siri Recap 旨在限制某些可能敏感的内容,例如财务信息、政府签发的身份标识等,但自动过滤可能无法移除所有敏感信息。

  2. 我们最新版本的 Siri(Siri AI)将以 Beta 版形式逐步推出。Siri AI 将于今年晚些时候推出 Beta 版,并且需要使用已启用 Apple 智能且设置为受支持语言的设备。Siri AI 初期将不在欧盟地区的 iOS、iPadOS 和 watchOS 上提供。

发布日期: