
大多数用户在向 ChatGPT 输入想法前,花费在阅读法律条款上的时间不足 10 秒。然而,规范后续数据处理的隐私政策篇幅超过 4,000 字,以成年人平均阅读速度读完需耗时 20 分钟以上。
默认设置的陷阱
这种时长差异掩盖了一个令人不安的现实:尽管主流大语言模型的隐私政策要求用户投入大量精力审阅,但极少有人愿意付出此等努力。用户通常直接点击“接受”,致使对话数据成为模型训练的一部分,并被公司保存数月甚至数年。尽管服务提供商不断调整默认设置,这一模式依然稳固。2025 年,OpenAI、Anthropic 和 Google 均调整了消费者端设置,将模型训练从“需主动选择加入(opt-in)”转变为“需主动选择退出(opt-out)”。随着数据保留期限延长,采用率飙升。面对每天数十亿次的查询,鲜有用户去调整那些被深埋的控制开关。后果随之叠加。单个提示词可能泄露健康状况、财务计划或专有代码。一旦发送,控制权即刻丧失。删除请求往往面临 30 天的缓冲期,期间人工审核员仍可能查看内容。此外,法院曾强制要求保留超出政策规定期限的数据。
审计揭示数据留存真相
Secret Chat AI 发布的 2026 年审计报告审查了 13 项服务,描绘出更清晰的图景。其中九项服务在默认或预选状态下将消费者对话纳入训练。主要提供商在用户删除数据后的保留时间从立即删除到 30 天不等;未删除的聊天记录服务器存储时长从零到五年,甚至无限期。仅有四项服务避免在服务器上保留可读的对话存档。具体而言,ChatGPT 在 OpenAI 服务器上无限期保留与账户关联的对话,直到用户手动删除, scheduled 永久删除将在 30 天内执行;其消费者套餐默认允许用于训练。若允许训练,Claude 的聊天记录可存储长达五年。Gemini 则将有人工审核的对话保留三年。这些并非抽象风险,它们直接决定了公司对个人了解的深度。PCMag 引用 Incogni 的排名,依据 11 项严格标准评估了 13 个平台。ChatGPT 和 Mistral’s Vibe 因侵入性做法较少且透明度高而得分最高;Microsoft Copilot、Meta AI 和 Kimi 则排名垫底。研究人员审查了政策、训练数据使用、第三方共享情况及控制选项的可查找性。数据来源于 2026 年中,部分政策在此后有所更新。
透明度参差不齐与人工审核风险
行业透明度参差不齐。OpenAI 因清晰解释数据使用(包括聊天消息)而获赞誉,其他公司则将细节隐藏于多份文件中。Dale-Chall 阅读难度指数证实,所有政策均要求具备大学水平的阅读理解能力。若无刻意努力,用户几乎无法胜任。默认设置主导着用户行为。2025 年 8 月,Anthropic 翻转了 Claude 消费者套餐的设置,将训练改为“需主动选择退出”,并将已选择加入数据的保留期延长至五年。这一变更适用于 Free、Pro 和 Max 账户。尽管现有用户收到弹窗通知,但许多人错过或未加阅读便予以接受。OpenAI 直至 2026 年 9 月 10 日才更新其美国隐私政策,称仅在服务所需或履行安全及法律义务期间保留个人数据,并强调用户可控制内容是否用于训练,公司不出售数据。然而,现实操作暴露了差距。2026 年 9 月的报道指出,OpenAI 雇佣数百名承包商阅读真实用户提示词。尽管设有“隐私过滤器”试图剥离个人信息,敏感细节仍可能漏网。Anthropic 和 Google 也存在类似的人工审核机制。临时聊天模式和退出选项虽能限制暴露,但无法完全消除风险。
企业级与个人级的分裂
企业级服务则截然不同。2026 年 8 月,OpenAI 为前沿模型推出零数据保留方案,通过“私有安全处理”维持安全保障。符合条件的 API 客户在处理后,提示词和输出均不被保留,除非用户选择加入,否则企业数据不会用于训练。Anthropic 也为商业计划提供类似的零保留选项。然而,自 2025 年底以来,consumer.claude.ai 默认进行训练。这种分裂造成了混淆:使用个人账户的员工可能在不知情的情况下使公司数据暴露,因为消费者端的默认设置同样适用。Google 的 Gemini 即使在删除后也会保留有人工审核的聊天记录长达三年,且默认活动日志用于训练。用户必须访问 myactivity.google.com 才能进行调整,但许多人从未这样做。Meta AI 则将公共内容纳入 AI 开发,在某些地区甚至没有明确的退出选项。
监管压力与用户应对
这些做法引发了诉讼和监管压力。《纽约时报》的案件迫使 OpenAI 在 2025 年将已删除的聊天记录保留数月;意大利监管机构对公司处以罚款。加州《训练数据透明度法案》今年生效,但批评者认为其高层级摘要要求薄弱。负责任的组织应将每个消费者聊天机器人视为公开渠道,切勿粘贴机密信息、代码、客户数据或个人健康细节。在可用时使用不保留历史记录和用于训练的临时聊天模式。对于必要工作,应选择带有零保留保证和数据处理附加协议的企业合作合同,并验证这些承诺是否写在具有约束力的文件中。每季度审计设置至关重要,因为政策会发生变化,Anthropic 的调整就曾让许多人措手不及。Incogni 研究人员强调,选择退出并不总是简单的。某些开关仅影响未来聊天,过去的数据可能仍然存在;经过人工审核的内容往往保留更久,删除并不总能收回一切。OpenAI 本周开始在 ChatGPT 中推出新的隐私中心,集中管理记忆、临时聊天、模型改进和数据导出等功能。然而,便利性往往胜出。聊天机器人提供的即时价值和个性化体验掩盖了代价:用户在比许多短篇小说还长的文件中签署了权利放弃书。服务提供商辩称,安全需求需要案例检测,模型改进需要真实对话,而零保留限制了针对多轮风险的某些安全措施,“私有安全处理”试图解决这一矛盾。尽管如此,信息不对称仍在加剧。公司确切知道用户分享了什么,而个人很少理解数据的下游用途。去标识化的数据可以无限期存在,聚合洞察训练出的未来系统可能与这些用户竞争,或对其画像。欧洲监管机构正加大施压力度,欧盟《人工智能法案》和 GDPR 创造了更严格的义务。美国各州增加了层层规定,但执法滞后。公司发布符合最低法律测试的政策,却很少超越它们。结果是一代用户在不知不觉中将其知识产权、情感宣泄和专业秘密捐赠给了私营公司。改变不仅需要更好的默认设置,更需要更短的须知、通俗易懂的摘要以及有利于隐私的技术默认值。在此之前,负担落在用户和组织身上,他们需尽力阅读、配置选项,并假设每个提示词都会进入永久记录——因为在实践中,这往往是事实。