谁在训练你的AI聊天数据?主要玩家审计

Reddit r/ArtificialInteligence 新闻

摘要

文章对OpenAI和Anthropic等主要AI提供商进行审计,发现他们默认在消费级计划中使用用户聊天数据进行训练,而退出选项往往隐藏在设置中。

暂无内容
查看原文
查看缓存全文

缓存时间: 2026/08/27 13:31

# 谁在用你的AI聊天数据训练模型?巨头审计 | 来源:https://rainverse.com/insights/ai-provider-privacy-big-players/ #### 第一部分 收听本文 加载中... **关于你日常使用的AI,这里有个令人不安的事实:大多数服务都会读取你的聊天记录进行训练。并非理论上的默认设置——而是实践中用户实际购买的套餐的默认设置。而且几乎没有人会去调整这个设置。** 打开一个全新的ChatGPT、Copilot或Gemini账户,在炒作开始前仔细阅读细则:几乎在所有情况下,**你的对话默认可用于训练下一代模型——除非你费力找到深藏在设置中的退出选项。**业界称此为“默认开启训练”。这是你的AI服务商隐私政策最不想让你读到的关键信息。 这是三篇系列文章的第一篇。这里我们根据服务商自身的说明(而非营销话术)对行业巨头进行审计。第二篇,我们将转向真正不使用用户数据训练的提供商,包括Venice以及少数从设计之初就以隐私为核心的服务。第三篇,我们将实操唯一本质100%私密的选择:在你控制的硬件上运行模型。 在开始前有个重要框架。以下所有主张均引自服务商自身的隐私或帮助中心页面,所有价格均取自服务商的定价页面(或当页面需登录时引用可靠的最新来源),**数据获取于2026年8月**。价格可能变动,但“谁在用你的数据训练”的默认设置已惊人地稳定。 --- ### 核心模式:默认开启,退出隐藏 消费级AI服务普遍采用一种设计:**对你而言,使用数据进行训练是默认开启的,关闭它则是一件麻烦事。**纵观主要服务商,情况高度一致: - 免费套餐和常规付费套餐**默认**使用你的聊天记录进行训练。 - **退出训练**通常对消费级用户可行——但这需要在设置页面中反复查找,大多数用户从未操作。 - **商业和企业级套餐**是例外:通常它们**不会**使用你的数据进行训练(因为你为此付费了)。 - 少数服务是真正的反例:**隐私优先设计**,你的内容从一开始就不会被存储或用于训练(将在第二篇详述)。 这就是同意鸿沟。不是“我们不使用你的数据”,而是“我们使用你的数据,除非你翻遍四个菜单来阻止我们”。 --- ### 主要服务商:根据其自身说明 #### OpenAI / ChatGPT — 消费级套餐默认进行训练 OpenAI的政策很直白:对于使用ChatGPT、Sora或Operator的个人用户,**“我们可能会使用你的内容训练我们的模型”**——默认开启,在隐私门户中有退出选项(ChatGPT定价页面的对比表确认所有消费级套餐“内容用于训练模型:提供退出选项”)。临时聊天不用于训练;商业线(ChatGPT Team、Enterprise、API)默认退出训练。2026年8月获取的价格:ChatGPT **Go套餐8美元/月**、**Plus套餐20美元/月**、**Pro套餐100或200美元/月**(来源:ChatGPT定价页面 https://chatgpt.com/pricing/)。 #### Anthropic / Claude — 曾以隐私著称但立场已软化 Anthropic曾建立其作为注重隐私的主要服务商的声誉:多年来消费级对话不用于训练其模型,且30天后删除。2025年情况改变。Anthropic的政策语言现在是**基于同意**的——它“在你选择允许的情况下”使用消费级聊天和编码会话(政策于2025年9/10月生效),如果你选择加入,数据保留期可达**5年**,不加入则保留**30天**。实际的默认设置存在争议:一些法律和合规分析认为消费级开关**默认开启**(你需要在设置 → 隐私中关闭它),而另一些则认为这是注册时的选择加入选项。底线是:消费级Claude不再是过去那个清晰的选择加入例外——请检查你自己的开关。 Anthropic仍然真正与众不同之处在于: - **即使是“模型改进”开启,“隐身聊天”也绝不会用于训练**。 - **安全豁免条款真实且异常透明**:即使你选择退出,被安全分类器标记的对话仍可能用于改进内部信任与安全模型——据报道,被标记的输入/输出保留约2年,分类分数保留约7年。 - **API提供了市场上最强的默认设置之一**:7天日志保留,不进行训练(2025年9月从30天缩短)。 - **Claude for Work和API**受商业条款覆盖,默认不进行训练。 - 随着欧盟AI透明度规则于2026年8月生效,Claude也是首批在输出中附加机器可读AI水印的主要服务商之一。 2026年8月获取的价格:Claude **Pro套餐20美元/月**(年付17美元/月)、**Max套餐100或200美元/月**(来源:Claude定价页面 https://claude.com/pricing)。 #### Google Gemini — 活动记录默认开启,人工审核,18个月自动删除 Google的Gemini Apps隐私中心显示,“保留活动记录”**默认开启**,聊天记录可能用于训练生成式AI模型,并由**人工审核员**审核(保留最长3年,与你的账户断开连接)。关闭“保留活动记录”后,未来的聊天将不会用于训练;默认自动删除周期为**18个月**。即使关闭此功能,Google仍使用聊天来响应和保护用户。2026年8月获取的价格:Google AI **Plus套餐4.99美元/月**、**Pro套餐19.99美元/月**、**AI Ultra套餐99.99或199.99美元/月**(最高套餐在2026年I/O大会从250美元下调)(来源:Google AI套餐页面 https://one.google.com/intl/en_us/about/google-ai-plairs/)。 #### Microsoft Copilot — 消费级默认开启训练,商业级永不 消费级Copilot对话默认保存(18个月存储期)并默认用于AI训练,已登录用户可选择退出。企业级Copilot(Microsoft 365 Copilot、Entra ID)**不**用于训练AI模型。值得注意的是政策有所调整:独立的消费级**Copilot Pro已被退役**并并入Microsoft 365 Premium,商业级Copilot套餐起价约为**18-21美元/用户/月(年付)**(18美元的入门价是至2026年9月的促销价——常规价21美元;最高套餐约32美元/用户/月)(来源:Microsoft 365 Copilot定价页面 https://www.microsoft.com/en-us/microsoft-365-copilot/pricing)(价格获取于2026年8月)。 #### Meta AI — 训练使用你分享的内容;你的私信保持私密 来自Meta的好消息是:当你在WhatsApp中使用Meta AI时,**Meta只能读取提及@Meta AI或你选择分享给它的消息——你的个人消息和通话保持端到端加密。**你与Meta AI本身的互动,加上来自你账户中心的数据,**可能默认被用于改进Meta的AI**。没有付费消费级套餐——Meta AI是免费的。 #### xAI / Grok — 默认使用你的内容进行训练 Grok的隐私政策(2026年4月生效)称,你的用户内容和输出默认用于训练其模型,同时包括公开的X帖子和互联网数据。真正私密的逃生通道是**“私人聊天”**,不会出现在历史记录中,并在30天内从xAI系统中删除。2026年8月获取的价格:**免费**、**SuperGrok套餐30美元/月**、**SuperGrok Plus套餐100美元/月**,以及**商业版30美元/用户/月**(团队使用,企业版定制)(来源:xAI定价页面 https://x.ai/pricing)。 #### DeepSeek — 默认训练,存储于中国 DeepSeek收集提示词、文件和聊天历史以“训练和改进”其模型,并且其政策声明个人数据**在中华人民共和国境内处理和存储**,只要你保留账户就一直存储。这也意味着**中华人民共和国法律管辖权**适用于这些数据的处理方式——这对许多读者而言是重要考量。有退出选项,但与西方提供商相比,控制处理的能力较弱。DeepSeek没有付费消费级套餐——该应用是免费的。 #### Mistral / Vibe — 更便宜,商业线以下默认训练 这家法国提供商(现将其助手品牌为“Vibe”)是经济型选择:Le Chat Pro套餐**14.99美元/月**(2026年8月获取,Mistral定价页面 https://mistral.ai/pricing/)。但隐私条款按套餐区分:**免费、Pro和教育套餐默认使用你的输入和输出进行训练**(除非你选择退出),而团队和企业套餐则不用于训练。 **为何你应该关心,而不仅仅是感到烦恼:**每次你的聊天记录用于训练,都是在*用你*的数据进行训练——你的私人问题、你的机密文件、你未成型的想法。对企业而言,使用默认开启训练的工具可能泄露本应留在公司内部的信息。隐私差异并非表面文章;它是一个真实的风险传递,也是对你选择的AI服务的信任考验。 --- ### 快速参考表:谁训练,谁可退出,谁永不训练 | 提供商 | 消费级默认设置 | 商业/企业级 | | :--- | :--- | :--- | | OpenAI / ChatGPT | 默认训练(提供退出选项) | 不训练(Team/Enterprise/API) | | Anthropic / Claude | 基于同意;默认设置有争议(定价页将消费级标记为“可退出”) | 不训练(Claude for Work/API) | | Google Gemini | 默认训练(保留活动记录开启) | — | | Microsoft Copilot | 默认训练(已登录用户可退出) | 不训练(M365 Copilot) | | Meta AI | 训练使用Meta AI互动内容 | — | | xAI / Grok | 默认训练 | 不训练(Business/Enterprise) | | DeepSeek | 默认训练(存储于中国) | — | | Mistral / Vibe | 默认训练(免费/Pro/教育) | 不训练(团队/企业) | 模式显而易见:**消费级套餐默认对你进行训练;付费商业套餐才是隐私所在。**如果你是个人用户,默认设置对你不利。如果你是企业,你是在付费获取默认退出训练的特权。 --- ### 核心要点 - **消费级AI的默认设置是“默认开启训练”,且退出选项隐蔽。**将主要服务商页面上的“我们尊重你的隐私”视为需要核实的主张,而非既定事实。 - **Anthropic的消费级立场现在基于同意,且其默认设置有争议**——它曾经清晰的选择加入例外已不复存在,因此请像对待其他服务商一样检查Claude的设置开关。 - **商业/企业套餐是主要服务商中你获取隐私的快捷方式:**这些套餐不训练你的数据,而你付费换取了这个特权。 - 如果你希望模型**字面上不保留你的对话记录**,从一开始就如此做的提供商寥寥无几——而这正是第二篇要探讨的内容。 *信息截至2026年8月;产品和定价细节可能变化——在依赖前请通过链接页面核实。本文不构成法律或安全建议。* --- ### 资料来源 - OpenAI — 你的数据如何用于改进模型性能:openai\.com/policies (https://openai.com/policies/how-your-data-is-used-to-improve-model-performance/) - OpenAI — ChatGPT定价:chatgpt\.com/pricing (https://chatgpt.com/pricing/) - Anthropic — 我的数据是否用于模型训练:privacy\.claude\.com (https://privacy.claude.com/en/articles/10023580-is-my-data-used-for-model-training) - Anthropic — 隐私政策更新(消费级训练 + 5年保留):privacy\.claude\.com (https://privacy.claude.com/en/articles/10301952-updates-to-our-privacy-policy) - Anthropic — 隐身聊天:support\.anthropic\.com (https://support.anthropic.com/en/articles/12260368-using-incognito-chats) - Anthropic — Claude定价:claude\.com/pricing (https://claude.com/pricing) - Google — Gemini Apps隐私中心:support\.google\.com (https://support.google.com/gemini/answer/13594961) - Google — AI套餐:one\.google\.com (https://one.google.com/intl/en_us/about/google-ai-plans/) - Microsoft — Copilot隐私常见问题:support\.microsoft\.com (https://support.microsoft.com/en-us/microsoft-copilot/privacy-faq-for-microsoft-copilot) - Microsoft — 365 Copilot定价:microsoft\.com (https://www.microsoft.com/en-us/microsoft-365-copilot/pricing) - Meta — WhatsApp Meta AI常见问题:faq\.whatsapp\.com (https://faq.whatsapp.com/623460230302218) - xAI — 隐私政策(2026年4月生效):x\.ai/legal (https://x.ai/legal/privacy-policy);定价:x\.ai/pricing (https://x.ai/pricing) - DeepSeek — 隐私政策:cdn\.deepseek\.com (https://cdn.deepseek.com/policies/en-US/deepseek-privacy-policy.html) - Mistral — 你是否使用我的数据训练模型:help\.mistral\.ai (https://help.mistral.ai/en/articles/347617-do-you-use-my-user-data-to-train-your-artificial-intelligence-models);定价:mistral\.ai/pricing (https://mistral.ai/pricing/)

相似文章

AI 的负责任和安全使用

OpenAI Blog

OpenAI 发布了一份关于 AI 负责任和安全使用的指南,为 ChatGPT 用户提供最佳实践,包括保持人类参与、验证信息、警惕偏见和在 AI 使用中保持透明度。

一种逃避AI监控的方法

Reddit r/ArtificialInteligence

一份禁用热门AI聊天机器人(如ChatGPT、Gemini、Claude和Copilot)训练数据收集的指南,并提及了一个名为UnSee的自定义扩展来简化流程。

确保人工智能在教育中的应用带来机遇

OpenAI Blog

OpenAI报告称,大学适龄用户是ChatGPT的最大采用群体,但其操作能力仅为高级用户水平的1%到10%,突显出巨大差距。教育机构可以通过将结构化人工智能融入课程及像ChatGPT Edu这样的项目来弥合这一差距。