← 返回博客
News11 分钟

苹果如今想用你的数据训练 AI,图像模型正处在靶心

发布于 2026年9月27日
苹果如今想用你的数据训练 AI,图像模型正处在靶心

苹果多年来一直把自己定位为隐私公司。它把“在你的 iPhone 上发生的事,就留在你的 iPhone 上”放上广告牌,把设备端处理作为卖点,并把隐私当作武器,用来攻击那些商业模式依赖数据的竞争对手。因此,当本月有报道称苹果现在想用用户数据训练 AI 模型时,这一反转引发了强烈冲击。

这则来自 Heise、并在 Hacker News 上被广泛转发的报道,描述了苹果对用用户内容训练模型这一立场的转变,同时附带了关于选择加入和隐私保护的常见保证。细节不如方向重要。一家靠不碰你的数据建立品牌的公司,如今却在寻找用这些数据训练的方法,而这两种立场之间的落差才是关键。

对图像生成而言,这不是一个抽象的政策问题。文本生图和图像编辑模型渴求的,正是用户不断产生的那类数据:照片、截图、绘画、编辑过的图像,以及人们用来描述自己想要什么的提示词。对于把文字变成图像的模型来说,最好的训练信号就是一大堆真实图片,并配上人们谈论它们的方式。实际上,每个 iPhone 用户都是一份行走的数据集,里面恰好装着这种成对数据。

与 OpenAI、谷歌和 Adobe 相比,苹果在图像生成方面一直很低调,但拼图已经就位。设备端生成、照片编辑功能,以及一套不断扩大的创意工具,都指向那些能从用户数据中获得巨大收益的模型。仅“照片”图库就是一个多数实验室都会羡慕的语料库:数十亿张带有位置、时间和人物标签的图像,是教模型理解“湖上日落”或“我女儿的生日”长什么样的原材料。问题在于,苹果能否在不破坏其差异化优势——信任——的前提下使用这些数据。

这种紧张并非苹果独有。每一家主要模型构建者都面临同样的经济账。训练数据是瓶颈,高质量数据稀缺,而用户内容就是最大的未开发池子。曾经拒绝用用户数据训练的公司,如今看着竞争对手这么做,也感受到跟进的压力。网络在很大程度上已被抓取殆尽,合成数据又有自身的质量限制,而训练数据的下一个前沿,就是人们在私密应用和设备中创造的东西。苹果的反转,只是许多公司正在悄悄做出的决定中最显眼的一个版本。

区分负责任与鲁莽做法的,是同意和透明,而不是训练行为本身。一个明确选择加入、知道自己数据被用于什么、并且可以随时撤销的用户,与一个图像被默认收集、淹没在没人读的服务条款更新里的用户,处境完全不同。关于苹果的报道表明,该公司正试图在两难中穿行:一边保留其隐私话术,一边为训练打开大门。这要么是基于同意的训练的真诚尝试,要么是一次精心管理的反转,取决于你愿意多宽容地看待它。

对图像数据来说,还有一个更深层的问题。照片不像搜索查询。它包含人物、地点和可识别个人的元数据,而且它是模型的原材料,这些模型之后可能生成与那些人相似的图像。“训练数据”和“肖像”之间的界线很快就变得模糊。用某人的脸训练模型,它可能就能复现那张脸,这会引发文本模型永远不必回答的同意、形象权和隐私问题。

本月,监管机构在 Grok 深度伪造案件中表明,他们愿意把滥用个人图像视为数据保护问题,而不仅仅是内容审核问题。英国信息专员办公室将未经同意的深度伪造定性为数据保护违规,而这种定性很容易延伸到企业最初如何收集和使用用于训练模型的图像。尤其是苹果,绝不想被抓到在没有严密同意的情况下用肖像进行训练。

对用户来说,实际的建议是仔细阅读提示和设置。默认选项可能并不利于你,而选择退出的能力只有在你知道它存在并能找到它时才有意义。当苹果推出任何训练选择加入时,去设置里找它,读清楚它实际说了什么,自己作决定,而不是一路点击通过。隐私设置的价值,只取决于你拿它做了什么。

对整个行业来说,苹果的举动是一个信号:隐私优先的 AI 抵制者时代正在结束。当连把隐私当作口号的苹果公司都开始用用户数据训练时,任何大型模型都是在没有你的图像的情况下构建出来的这一假设,就更难维持了。这也提高了其他所有人的风险。如果苹果能在获得同意的情况下用用户数据训练并取得成功,就会让这种做法合法化。如果它失手并被发现做得很糟糕,就会加强人们对某种监管的呼声——而 Grok 丑闻已经在推动这种监管。

苹果很可能会继续保留其隐私叙事,因为叙事本身就是产品。真正的问题是,这套叙事是否仍在描述实际发生的事,还是只描述了营销团队想让你感受到的东西。答案,就像眼下 AI 的大多数事情一样,仍在书写之中,而且它会先写在设置界面的细则里,再写进任何新闻稿。

还有一个容易被忽视的竞争维度。相对于竞争对手,苹果在生成式 AI 上起步较晚,而且这种晚伤及了它作为技术领导者的形象。追赶的压力真实存在,而训练数据就是决定它能否追赶上的约束。一家在竞争对手都使用用户数据训练时拒绝这么做的公司,等于选择绑起一只手作战。苹果的反转——如果算反转的话——既关乎留在竞赛中,也关乎任何理念转变。当苹果还不想在 AI 上竞争时,隐私品牌是一种差异化优势。如今它想竞争了,品牌和野心便朝着相反方向拉扯。

对图像生成来说,这种紧张关系的利害很具体。苹果的照片生态系统可以说是它最强大却未充分利用的资产。照片 App、编辑工具、硬件摄像头,这一切都在产生源源不断的高质量、标注良好的图像数据,多数 AI 实验室会愿意为此花大价钱。如果苹果能在获得真正同意的情况下用这些数据训练图像模型,它就可能超越那些困在抓取网络数据上的竞争对手。如果做不到,它就只能看着这项资产闲置,而别人蚕食它的创意工具市场。这才是政策故事背后的真正奖品。

同意机制将是苹果受到最密切关注的地方。该公司历来通过选择加入提示来包装数据收集,而许多用户只是匆匆一瞥便接受。这算不算有意义的同意,正是监管机构开始提出的问题,也是 Grok 深度伪造案件迫使浮出水面的同一个问题。苹果在这件事上搞砸的损失比大多数公司都大,因为它的全部声誉都押在“它做隐私的方式不同”这一说法上。如果这一说法被证明只是营销,损害就不只是法律层面的,而是品牌层面的,还会削弱苹果仍然可靠拥有的那一项优势。

相关文章