科技公司正在重新定义“录音”,我们不该轻易接受
当“录音”不再叫录音
在大多数人的认知里,一台带有麦克风或摄像头的设备,要么在录,要么没录;要么开着,要么关着。中间没有太多灰色地带。麦克风捕捉声音,摄像头捕捉画面,这些数据被保存下来——有时还会上传到云端进行处理——它就是一个被保留的时间切片,也就是“录音”。
但科技公司现在想让这个定义变得模糊。
据 Bloomberg 记者 Mark Gurman 报道,Apple 正在开发一款智能家居摄像头,它不保存视频录像。取而代之的是,AI 利用视觉数据生成描述家中情况的文字片段。据说它支持人脸识别,但不保留视频画面。Gurman 表示,这项技术与传闻中未来 AirPods 上的摄像头工作方式类似。
这听起来像是在保护隐私——没有视频,就没有隐私泄露。但问题在于:它真的没有在“记录”吗?
Apple Watch 上的争议
同样的逻辑也出现在 Apple Watch Series 12 和 Apple Watch Ultra 4 的 Audio Intelligence 功能上。Apple Watch 早就配备了麦克风,主要用于 Siri 和接打电话。但在 Audio Intelligence 的四项功能中,有两项引发了大量讨论:Live Rewind 和 Siri Recap。前者生成过去 15 秒的文字转录,后者则能对你一天中进行的对话生成高层摘要。
所有 Audio Intelligence 功能都需要用户主动选择开启。Apple 在 Music Detection 的说明中明确写道,它“不录制音频”。但一旦一首歌被识别出来,那段音频数据难道就没有被处理过吗?
重新定义“录音”意味着什么
科技公司正在推动一种新的叙事:只要不保存原始的音视频文件,就不算“录音”。数据被实时处理、转化为文字或摘要后即被丢弃,因此可以被视为“没有记录”。
但这种定义上的转变值得警惕。原因有三:
- 处理即接触:即使数据不被保存,AI 模型仍然“接触”了你的声音和画面。处理过程中是否存在临时缓存、日志或模型微调的可能,用户往往无从得知。
- 同意疲劳:当“始终监听”的设备被包装成“不录音”,用户对隐私设置的敏感度会下降,真正的知情同意变得更难实现。
- 法律与监管滞后:许多地区的窃听和录音法律建立在“录制即保存”的传统定义上。如果企业单方面改变定义,法律保护可能出现真空。
我们需要坚持什么
“录音”的定义不应该由科技公司单方面改写。如果一台设备持续捕捉环境中的声音和图像,并利用这些数据生成可读、可存储、可检索的文字摘要,那么它在功能上就是在记录。
用户有权知道:数据被处理了多久?是否被用于训练?摘要存储在哪里?谁可以访问?
这些问题不会因为“我们不保存视频”而消失。相反,它们变得更加重要——因为当“录音”这个词被重新定义时,我们失去的不仅是一个词汇,而是对自身隐私边界的清晰认知。
