OpenAI 可以使用所有付费用户的交互,即使他们选择了退出训练

Reddit r/LocalLLaMA 新闻

摘要

文章揭示,由于推理令牌未被归类为用户拥有的输出这一漏洞,OpenAI 的条款允许其使用付费用户的交互进行训练,尽管存在退出选项。

他们的退出条款似乎不适用于推理令牌。由于消费者没有从 OpenAI 收到隐藏的推理令牌,因此不清楚这是否算作受付费用户退出策略保护的“输出”。例如,条款说我们对输出负责并拥有它,这对推理令牌来说是不可能的。这一点很重要,因为推理包含了所有对训练有用的内容的轻度处理版本,包括用户输入和返回给用户的输出,使得 OpenAI 当前的保证有些空洞。相比之下,OpenAI 服务协议(API)和 Anthropic 条款没有提到用户“接收”受退出保护的输出。如果属实,推理令牌可以用于生成合成数据以改进他们的模型,以及直接放入预训练或中期训练混合中。这与他们所说的不在 CoT 上施加 RL 优化压力不冲突。
查看原文

相似文章

谁在训练你的AI聊天数据?主要玩家审计

Reddit r/ArtificialInteligence

文章对OpenAI和Anthropic等主要AI提供商进行审计,发现他们默认在消费级计划中使用用户聊天数据进行训练,而退出选项往往隐藏在设置中。

OpenAI:只需这样做,每日获赠免费令牌

Reddit r/artificial

OpenAI 通过其数据共享计划提供每日免费 API 令牌(轻量模型最高 250 万令牌),只需在仪表盘中切换一个设置即可启用;代价是提示词和输出可能被用于训练。

OpenAI的监控抄袭

Reddit r/LocalLLaMA

OpenAI被证实未经明确选择加入就使用用户数据和会话训练其内部模型,引发伦理担忧,并呼吁使用本地运行的开放权重模型以保护数据。