谁在训练你的AI聊天数据?主要玩家审计
摘要
文章对OpenAI和Anthropic等主要AI提供商进行审计,发现他们默认在消费级计划中使用用户聊天数据进行训练,而退出选项往往隐藏在设置中。
暂无内容
查看缓存全文
缓存时间: 2026/08/27 13:31
# 谁在用你的AI聊天数据训练模型?巨头审计 |
来源:https://rainverse.com/insights/ai-provider-privacy-big-players/
#### 第一部分
收听本文
加载中...
**关于你日常使用的AI,这里有个令人不安的事实:大多数服务都会读取你的聊天记录进行训练。并非理论上的默认设置——而是实践中用户实际购买的套餐的默认设置。而且几乎没有人会去调整这个设置。**
打开一个全新的ChatGPT、Copilot或Gemini账户,在炒作开始前仔细阅读细则:几乎在所有情况下,**你的对话默认可用于训练下一代模型——除非你费力找到深藏在设置中的退出选项。**业界称此为“默认开启训练”。这是你的AI服务商隐私政策最不想让你读到的关键信息。
这是三篇系列文章的第一篇。这里我们根据服务商自身的说明(而非营销话术)对行业巨头进行审计。第二篇,我们将转向真正不使用用户数据训练的提供商,包括Venice以及少数从设计之初就以隐私为核心的服务。第三篇,我们将实操唯一本质100%私密的选择:在你控制的硬件上运行模型。
在开始前有个重要框架。以下所有主张均引自服务商自身的隐私或帮助中心页面,所有价格均取自服务商的定价页面(或当页面需登录时引用可靠的最新来源),**数据获取于2026年8月**。价格可能变动,但“谁在用你的数据训练”的默认设置已惊人地稳定。
---
### 核心模式:默认开启,退出隐藏
消费级AI服务普遍采用一种设计:**对你而言,使用数据进行训练是默认开启的,关闭它则是一件麻烦事。**纵观主要服务商,情况高度一致:
- 免费套餐和常规付费套餐**默认**使用你的聊天记录进行训练。
- **退出训练**通常对消费级用户可行——但这需要在设置页面中反复查找,大多数用户从未操作。
- **商业和企业级套餐**是例外:通常它们**不会**使用你的数据进行训练(因为你为此付费了)。
- 少数服务是真正的反例:**隐私优先设计**,你的内容从一开始就不会被存储或用于训练(将在第二篇详述)。
这就是同意鸿沟。不是“我们不使用你的数据”,而是“我们使用你的数据,除非你翻遍四个菜单来阻止我们”。
---
### 主要服务商:根据其自身说明
#### OpenAI / ChatGPT — 消费级套餐默认进行训练
OpenAI的政策很直白:对于使用ChatGPT、Sora或Operator的个人用户,**“我们可能会使用你的内容训练我们的模型”**——默认开启,在隐私门户中有退出选项(ChatGPT定价页面的对比表确认所有消费级套餐“内容用于训练模型:提供退出选项”)。临时聊天不用于训练;商业线(ChatGPT Team、Enterprise、API)默认退出训练。2026年8月获取的价格:ChatGPT **Go套餐8美元/月**、**Plus套餐20美元/月**、**Pro套餐100或200美元/月**(来源:ChatGPT定价页面 https://chatgpt.com/pricing/)。
#### Anthropic / Claude — 曾以隐私著称但立场已软化
Anthropic曾建立其作为注重隐私的主要服务商的声誉:多年来消费级对话不用于训练其模型,且30天后删除。2025年情况改变。Anthropic的政策语言现在是**基于同意**的——它“在你选择允许的情况下”使用消费级聊天和编码会话(政策于2025年9/10月生效),如果你选择加入,数据保留期可达**5年**,不加入则保留**30天**。实际的默认设置存在争议:一些法律和合规分析认为消费级开关**默认开启**(你需要在设置 → 隐私中关闭它),而另一些则认为这是注册时的选择加入选项。底线是:消费级Claude不再是过去那个清晰的选择加入例外——请检查你自己的开关。
Anthropic仍然真正与众不同之处在于:
- **即使是“模型改进”开启,“隐身聊天”也绝不会用于训练**。
- **安全豁免条款真实且异常透明**:即使你选择退出,被安全分类器标记的对话仍可能用于改进内部信任与安全模型——据报道,被标记的输入/输出保留约2年,分类分数保留约7年。
- **API提供了市场上最强的默认设置之一**:7天日志保留,不进行训练(2025年9月从30天缩短)。
- **Claude for Work和API**受商业条款覆盖,默认不进行训练。
- 随着欧盟AI透明度规则于2026年8月生效,Claude也是首批在输出中附加机器可读AI水印的主要服务商之一。
2026年8月获取的价格:Claude **Pro套餐20美元/月**(年付17美元/月)、**Max套餐100或200美元/月**(来源:Claude定价页面 https://claude.com/pricing)。
#### Google Gemini — 活动记录默认开启,人工审核,18个月自动删除
Google的Gemini Apps隐私中心显示,“保留活动记录”**默认开启**,聊天记录可能用于训练生成式AI模型,并由**人工审核员**审核(保留最长3年,与你的账户断开连接)。关闭“保留活动记录”后,未来的聊天将不会用于训练;默认自动删除周期为**18个月**。即使关闭此功能,Google仍使用聊天来响应和保护用户。2026年8月获取的价格:Google AI **Plus套餐4.99美元/月**、**Pro套餐19.99美元/月**、**AI Ultra套餐99.99或199.99美元/月**(最高套餐在2026年I/O大会从250美元下调)(来源:Google AI套餐页面 https://one.google.com/intl/en_us/about/google-ai-plairs/)。
#### Microsoft Copilot — 消费级默认开启训练,商业级永不
消费级Copilot对话默认保存(18个月存储期)并默认用于AI训练,已登录用户可选择退出。企业级Copilot(Microsoft 365 Copilot、Entra ID)**不**用于训练AI模型。值得注意的是政策有所调整:独立的消费级**Copilot Pro已被退役**并并入Microsoft 365 Premium,商业级Copilot套餐起价约为**18-21美元/用户/月(年付)**(18美元的入门价是至2026年9月的促销价——常规价21美元;最高套餐约32美元/用户/月)(来源:Microsoft 365 Copilot定价页面 https://www.microsoft.com/en-us/microsoft-365-copilot/pricing)(价格获取于2026年8月)。
#### Meta AI — 训练使用你分享的内容;你的私信保持私密
来自Meta的好消息是:当你在WhatsApp中使用Meta AI时,**Meta只能读取提及@Meta AI或你选择分享给它的消息——你的个人消息和通话保持端到端加密。**你与Meta AI本身的互动,加上来自你账户中心的数据,**可能默认被用于改进Meta的AI**。没有付费消费级套餐——Meta AI是免费的。
#### xAI / Grok — 默认使用你的内容进行训练
Grok的隐私政策(2026年4月生效)称,你的用户内容和输出默认用于训练其模型,同时包括公开的X帖子和互联网数据。真正私密的逃生通道是**“私人聊天”**,不会出现在历史记录中,并在30天内从xAI系统中删除。2026年8月获取的价格:**免费**、**SuperGrok套餐30美元/月**、**SuperGrok Plus套餐100美元/月**,以及**商业版30美元/用户/月**(团队使用,企业版定制)(来源:xAI定价页面 https://x.ai/pricing)。
#### DeepSeek — 默认训练,存储于中国
DeepSeek收集提示词、文件和聊天历史以“训练和改进”其模型,并且其政策声明个人数据**在中华人民共和国境内处理和存储**,只要你保留账户就一直存储。这也意味着**中华人民共和国法律管辖权**适用于这些数据的处理方式——这对许多读者而言是重要考量。有退出选项,但与西方提供商相比,控制处理的能力较弱。DeepSeek没有付费消费级套餐——该应用是免费的。
#### Mistral / Vibe — 更便宜,商业线以下默认训练
这家法国提供商(现将其助手品牌为“Vibe”)是经济型选择:Le Chat Pro套餐**14.99美元/月**(2026年8月获取,Mistral定价页面 https://mistral.ai/pricing/)。但隐私条款按套餐区分:**免费、Pro和教育套餐默认使用你的输入和输出进行训练**(除非你选择退出),而团队和企业套餐则不用于训练。
**为何你应该关心,而不仅仅是感到烦恼:**每次你的聊天记录用于训练,都是在*用你*的数据进行训练——你的私人问题、你的机密文件、你未成型的想法。对企业而言,使用默认开启训练的工具可能泄露本应留在公司内部的信息。隐私差异并非表面文章;它是一个真实的风险传递,也是对你选择的AI服务的信任考验。
---
### 快速参考表:谁训练,谁可退出,谁永不训练
| 提供商 | 消费级默认设置 | 商业/企业级 |
| :--- | :--- | :--- |
| OpenAI / ChatGPT | 默认训练(提供退出选项) | 不训练(Team/Enterprise/API) |
| Anthropic / Claude | 基于同意;默认设置有争议(定价页将消费级标记为“可退出”) | 不训练(Claude for Work/API) |
| Google Gemini | 默认训练(保留活动记录开启) | — |
| Microsoft Copilot | 默认训练(已登录用户可退出) | 不训练(M365 Copilot) |
| Meta AI | 训练使用Meta AI互动内容 | — |
| xAI / Grok | 默认训练 | 不训练(Business/Enterprise) |
| DeepSeek | 默认训练(存储于中国) | — |
| Mistral / Vibe | 默认训练(免费/Pro/教育) | 不训练(团队/企业) |
模式显而易见:**消费级套餐默认对你进行训练;付费商业套餐才是隐私所在。**如果你是个人用户,默认设置对你不利。如果你是企业,你是在付费获取默认退出训练的特权。
---
### 核心要点
- **消费级AI的默认设置是“默认开启训练”,且退出选项隐蔽。**将主要服务商页面上的“我们尊重你的隐私”视为需要核实的主张,而非既定事实。
- **Anthropic的消费级立场现在基于同意,且其默认设置有争议**——它曾经清晰的选择加入例外已不复存在,因此请像对待其他服务商一样检查Claude的设置开关。
- **商业/企业套餐是主要服务商中你获取隐私的快捷方式:**这些套餐不训练你的数据,而你付费换取了这个特权。
- 如果你希望模型**字面上不保留你的对话记录**,从一开始就如此做的提供商寥寥无几——而这正是第二篇要探讨的内容。
*信息截至2026年8月;产品和定价细节可能变化——在依赖前请通过链接页面核实。本文不构成法律或安全建议。*
---
### 资料来源
- OpenAI — 你的数据如何用于改进模型性能:openai\.com/policies (https://openai.com/policies/how-your-data-is-used-to-improve-model-performance/)
- OpenAI — ChatGPT定价:chatgpt\.com/pricing (https://chatgpt.com/pricing/)
- Anthropic — 我的数据是否用于模型训练:privacy\.claude\.com (https://privacy.claude.com/en/articles/10023580-is-my-data-used-for-model-training)
- Anthropic — 隐私政策更新(消费级训练 + 5年保留):privacy\.claude\.com (https://privacy.claude.com/en/articles/10301952-updates-to-our-privacy-policy)
- Anthropic — 隐身聊天:support\.anthropic\.com (https://support.anthropic.com/en/articles/12260368-using-incognito-chats)
- Anthropic — Claude定价:claude\.com/pricing (https://claude.com/pricing)
- Google — Gemini Apps隐私中心:support\.google\.com (https://support.google.com/gemini/answer/13594961)
- Google — AI套餐:one\.google\.com (https://one.google.com/intl/en_us/about/google-ai-plans/)
- Microsoft — Copilot隐私常见问题:support\.microsoft\.com (https://support.microsoft.com/en-us/microsoft-copilot/privacy-faq-for-microsoft-copilot)
- Microsoft — 365 Copilot定价:microsoft\.com (https://www.microsoft.com/en-us/microsoft-365-copilot/pricing)
- Meta — WhatsApp Meta AI常见问题:faq\.whatsapp\.com (https://faq.whatsapp.com/623460230302218)
- xAI — 隐私政策(2026年4月生效):x\.ai/legal (https://x.ai/legal/privacy-policy);定价:x\.ai/pricing (https://x.ai/pricing)
- DeepSeek — 隐私政策:cdn\.deepseek\.com (https://cdn.deepseek.com/policies/en-US/deepseek-privacy-policy.html)
- Mistral — 你是否使用我的数据训练模型:help\.mistral\.ai (https://help.mistral.ai/en/articles/347617-do-you-use-my-user-data-to-train-your-artificial-intelligence-models);定价:mistral\.ai/pricing (https://mistral.ai/pricing/)
相似文章
AI 的负责任和安全使用
OpenAI 发布了一份关于 AI 负责任和安全使用的指南,为 ChatGPT 用户提供最佳实践,包括保持人类参与、验证信息、警惕偏见和在 AI 使用中保持透明度。
OpenAI正在打造适用于各种场景的AI代理,人们都会使用它们吗?
OpenAI通过推出ChatGPT Work扩展其AI代理能力,旨在为不同职业自动化任务,使AI超越软件工程师,但引发数据控制和采用的担忧。
一种逃避AI监控的方法
一份禁用热门AI聊天机器人(如ChatGPT、Gemini、Claude和Copilot)训练数据收集的指南,并提及了一个名为UnSee的自定义扩展来简化流程。
确保人工智能在教育中的应用带来机遇
OpenAI报告称,大学适龄用户是ChatGPT的最大采用群体,但其操作能力仅为高级用户水平的1%到10%,突显出巨大差距。教育机构可以通过将结构化人工智能融入课程及像ChatGPT Edu这样的项目来弥合这一差距。
你的个人数据可能正在被用于训练AI — 而大多数人毫不知情
本文讨论了个人数据如何在未经同意的情况下常用于AI训练,强调了隐私担忧,并介绍了一个名为'Don't Train Me'的工具,该工具自动化退出请求以保护用户数据。