OpenAI 和 Microsoft 知道他们正在为网络开启一个‘末日循环’

The Verge 新闻

摘要

法院文件显示,OpenAI 和 Microsoft 知道他们为AI训练进行的数据抓取行为可能会创建一个损害网络的‘末日循环’,并且构成‘人类历史上最大的劳动盗窃’,正如《纽约时报》诉讼中所指控的。

<figure> <img alt="叠加了电路板图形的头骨。" data-caption="" data-portal-copyright="图片:Cath Virginia / The Verge, Getty Images" data-has-syndication-rights="1" src="https://platform.theverge.com/wp-content/uploads/sites/2/2026/09/STKS534_AI_DOOMSDAY2_B.png?quality=90&#038;strip=all&#038;crop=0,0,100,100" /> <figcaption> </figcaption> </figure> <p class="wp-block-paragraph">最近公开的<a href="https://www.theverge.com/ai-artificial-intelligence/997312/a-microsoft-exec-called-ai-scraping-theft-of-unprecedented-proportions">法院文件</a>在<a href="https://www.nytimes.com/2026/09/04/technology/openai-microsoft-new-york-times-lawsuit.html"><em>纽约时报</em>诉 OpenAI 和 Microsoft 案</a>中相当不利。公司自己的文件警告称,他们正在开启一个会损害网络的“末日循环”,将数据抓取以训练模型的行为描述为“人类历史上最大的劳动盗窃”,并且称其“完全嘲弄了合理使用的理念”。</p> <p class="wp-block-paragraph">文件中许多最引人注目的引述来自 Microsoft 的应用科学总监 Brent Hecht。尽管该公司试图与 Hecht 的断言保持距离。Microsoft 发言人 Alex Haurek 告诉 The Verge,“这些评论反映了……”</p> <p><a href="https://www.theverge.com/ai-artificial-intelligence/997633/openai-microsoft-chatgpt-ai-new-york-times-doom-loop-theft-google-zero">在 The Verge 阅读完整故事。</a></p>
查看原文
查看缓存全文

缓存时间: 2026/09/18 21:20

# OpenAI与微软明知其行为将为互联网开启“死亡螺旋” 来源:https://www.theverge.com/ai-artificial-intelligence/997633/openai-microsoft-chatgpt-ai-new-york-times-doom-loop-theft-google-zero 最近解封的法庭文件(https://www.theverge.com/ai-artificial-intelligence/997312/a-microsoft-exec-called-ai-scraping-theft-of-unprecedented-proportions)揭示了《纽约时报》诉OpenAI与微软一案(https://www.nytimes.com/2026/09/04/technology/openai-microsoft-new-york-times-lawsuit.html)中的惊人细节。两家企业内部文件明确警告其行为正在形成损害互联网生态的“死亡螺旋”,将数据抓取训练模型的行为定性为“人类历史上最大规模的劳动剥削”,并承认此举“彻底嘲弄了合理使用原则的初衷”。 文件中最引人注目的引述多来自微软应用科学总监布伦特·赫克特。尽管微软试图与其言论划清界限——公司发言人亚历克斯·豪瑞克向The Verge表示:“这些评论仅反映个别员工的个人观点,非法律分析,不代表公司立场。” 在另一份法庭文件中,微软AI数据战略与运营总经理乔丹·乌斯丹将赫克特的角色描述为“对抗性”的。他称赫克特“对AI数据生态系统的运作持有迥异的、学术性的前瞻性观点,受雇于微软旨在提供非对称、未来主义且学术化的观点...他并非就AI对内容创作者的潜在影响发表微软官方理论观点的代表。” 但无论微软是否愿意承认这些言论,事实已然印证——谷歌归零现象(Google Zero)真实存在!AI正在吞噬互联网! 《纽约时报》提交的92页文件中,萨蒂亚·纳德拉、萨姆·奥尔特曼等OpenAI高管及员工的惊人言论俯拾皆是,以下为部分核心内容摘录: **“惊人的盗窃行为”** [![正如微软应用科学总监[布伦特·赫克特]所言,本案涉及的是“规模空前的惊人盗窃”(SF1437),堪称“人类历史上最大规模的劳动剥削”(SF1652)。被告反复未经许可完整复制原告数百万篇受版权保护的文章,用于开发替代性商业AI产品。ChatGPT负责人指出,这类产品让出版商面临“生存威胁”(SF1466),并表示这些产品“本质上具有替代性”且“随着技术进步替代性将持续增强”(SF1473-74)。此类承认彻底瓦解了被告的“合理使用”抗辩,因为替代性正是“版权制度的天敌”。(Andy Warhol Foundation for the Visual Arts, Inc. v. Goldsmith, 598 U.S. 508, 528 (2023))正如那位微软高管所承认的,若被告在此辩护上获胜,将“彻底嘲弄‘合理使用’原则的本意”(SF1450)。](https://platform.theverge.com/wp-content/uploads/sites/2/2026/09/Screenshot-2026-09-18-at-12.47.37-PM.png?quality=90&strip=all&crop=0%2C0%2C100%2C100&w=2400)](https://platform.theverge.com/wp-content/uploads/sites/2/2026/09/Screenshot-2026-09-18-at-12.47.37-PM.png?quality=90&strip=all&crop=0,0,100,100) 导言部分引用的赫克特与ChatGPT负责人(推测为尼克·特利)的言论,显示两家企业明知其产品对《纽约时报》等出版商构成“生存威胁”。赫克特将ChatGPT与Copilot的数据获取行为称为“人类历史上最大规模的劳动剥削”,并指出微软的辩护“彻底嘲弄了‘合理使用’原则”。 **形成“死亡螺旋”** 微软CEO萨蒂亚·纳德拉在宣誓作证时承认,与聊天机器人对话“已实现信息替代——用户直接从AI平台获取信息,无需访问原始网页”(SF1432)。一份微软内部文件坦承这种模式无人获益:“我们的AI内容战略已开启‘死亡螺旋’,将同时损害模型性能与整个网络生态:终端产品威胁其核心供应商经济基础的情况极为罕见,但正是我们在LLM业务与其‘内容供应链’之间制造了这种局面。”(https://platform.theverge.com/wp-content/uploads/sites/2/2026/09/doom-loop.png?quality=90&strip=all&crop=0,0,100,100) 萨蒂亚·纳德拉承认聊天机器人已实质取代搜索功能,消除了用户访问原始信息源的必要性。但更具破坏性的是微软内部文件所述:“我们的AI内容战略已开启‘死亡螺旋’,将同时损害模型性能与整个网络生态:终端产品威胁其核心供应商经济基础的情况极为罕见,但正是我们在LLM业务与其‘内容供应链’之间制造了这种局面。” **数字本身存在虚假性** 同期,OpenAI联合创始人格雷格·布罗克曼曾表示,其商业化技术的动力源于“对海量财富的渴望”(SF630)。近期有报道称OpenAI正计划基于万亿美元估值进行首次公开募股(IPO)。(https://platform.theverge.com/wp-content/uploads/sites/2/2026/09/gazillions.png?quality=90&strip=all&crop=0,0,100,100) 莫被OpenAI或微软的利他主义说辞蒙蔽。OpenAI联合创始人格雷格·布罗克曼更关注的是通过商业AI可能获得的“海量财富”。 **付费墙形同虚设** OpenAI与微软内部人员在数据获取过程中忽视了绕过付费墙、违反使用条款等问题(SF521-47, 790-92)。例如,OpenAI公司代表作证称其“不知晓任何检测训练数据集中付费墙内容的努力”,也“未尝试从训练数据集中移除付费墙内容”。(https://platform.theverge.com/wp-content/uploads/sites/2/2026/09/paywall.png?quality=90&strip=all&crop=0,0,100,100) 尽管纳德拉后来被引述称“任何付费墙内容都应获得授权”,但OpenAI代表承认其“不知晓”任何检测或移除训练数据中付费墙内容的努力。 **“对内容再现能力达到疯狂水平”** [![同年,OpenAI意识到其API“可能逐字输出现有内容”(SF945)。至2021年,OpenAI认为防止模型记忆化对于“遵守合理使用规范及最小化模型输出中的版权侵犯”至关重要(SF946)。2022年6月,OpenAI员工承认GPT-4将“记忆海量数据,因此对内容再现能力将达到疯狂水平”。](https://platform.theverge.com/wp-content/uploads/sites/2/2026/09/regurgitation.png?quality=90&strip=all&crop=0%2C0%2C100%2C100&w=2400)](https://platform.theverge.com/wp-content/uploads/sites/2/2026/09/regurgitation.png?quality=90&strip=all&crop=0,0,100,100) 内部资料显示,OpenAI深知ChatGPT存在逐字复制版权材料的倾向。尽管其承认“防止记忆化”对“最小化版权侵犯”至关重要,但员工仍表示GPT-4“记忆了海量数据,因此对内容再现能力将达到疯狂水平”。 文件随后列举多个实例,显示ChatGPT在回应查询时直接输出《纽约时报》《圣何塞信使报》《丹佛邮报》《生活骇客》及《Eurogamer》等媒体文章的长段原文。 **“收割”所有创作成果** 正如微软所承认的:“全球数百万民众很快将认为大型模型‘收割’其所有创作成果的行为,构成规模空前的惊人盗窃”,并坦言“几乎无人愿意其创作内容以此种方式被使用,创作者也未因此获得补偿”。(https://platform.theverge.com/wp-content/uploads/sites/2/2026/09/unnamed_81a3de.png?quality=90&strip=all&crop=0,0,100,100) 微软清楚其大规模抓取互联网的行为将引发何种观感,并承认“几乎无人愿意其创作内容以此种方式被使用,创作者也未因此获得补偿”。 **“替代人类劳动”** [![OpenAI政策总监杰克·克拉克同样写道:“我们在AI与创意领域的研究,将日益导致我们创造替代定义社会‘文化’的劳动者工作的系统”(SF1677)。OpenAI内部文件将ChatGPT描述为“现代报刊亭”(SF1500),并宣称其提供“快速及时的答案...包括‘最新体育比分、新闻、股票行情等’,而这些信息以往需要通过搜索引擎获取”。](https://platform.theverge.com/wp-content/uploads/sites/2/2026/09/substitute.png?quality=90&strip=all&crop=0%2C0%2C100%2C100&w=2400)](https://platform.theverge.com/wp-content/uploads/sites/2/2026/09/substitute.png?quality=90&strip=all&crop=0,0,100,100) OpenAI政策总监杰克·克拉克预见到这一趋势,称其正在“创造替代定义社会‘文化’的劳动者工作的系统”。内部文件将ChatGPT描述为“现代报刊亭”。OpenAI的尼克·特利后来被引述表示,一旦从聊天机器人获得答案,就“没有理由点击”原始链接。 **摧毁自身供应链** [![被告承认了这一设计的可预见后果。微软指出:“大语言模型的价值主要来自其获取内容的同一信息工作领域...它们天然与内容供应链竞争”(SF1798)。这些模型替代了生产其训练原始内容的“人类劳动者”,包括报纸、图书等内容(SF1452, 1677)。生成式AI“存在显著破坏基础模型训练数据提供者就业”的“现实风险”(SF1467)。“大语言模型是一种摧毁自身供应链的产品”。](https://platform.theverge.com/wp-content/uploads/sites/2/2026/09/destroys.png?quality=90&strip=all&crop=0%2C0%2C100%2C100&w=2400)](https://platform.theverge.com/wp-content/uploads/sites/2/2026/09/destroys.png?quality=90&strip=all&crop=0,0,100,100) 微软被引述承认“大语言模型是摧毁自身供应链的产品”,因其在多数情况下已成为训练数据的替代品。 **OpenAI知晓其正在扼杀引荐流量** OpenAI经济专家戈德法布博士指出:“我发现《纽约时报》网站引荐流量的下降,是多重因素共同作用的结果”,其中包括“例如谷歌AI概览功能”(SF1784, 1786)。戈德法布博士还推测“谷歌AI概览功能可能使DNP的搜索引荐量下降20%至60%”(SF1785)。OpenAI媒体专家辛赖希博士基于路透社新闻研究所2026年分析指出:“自谷歌引入AI概览功能后,来自谷歌搜索和谷歌发现对出版商的引荐流量大幅下降(通过发现功能的月度引荐量从超50亿次降至不足40亿次,通过搜索功能的引荐量从逾30亿次降至略超20亿次)”(SF1787)。辛赖希博士同时承认谷歌引荐流量下降与AI生成的摘要内容等因素相关。(https://platform.theverge.com/wp-content/uploads/sites/2/2026/09/referral-traffic.png?quality=90&strip=all&crop=0,0,100,100) OpenAI自身的媒体与经济专家将《纽约时报》等网站引荐流量的下降直接归因于谷歌AI概览等AI摘要功能。他们推测搜索引荐量可能已下降高达60%。 微软发言人豪瑞克强调:“萨蒂亚的证词与微软在本案中的立场完全一致。他阐述的是人们寻找与获取信息方式正在发生转变的宏观原则。这些观察不应与法院待决的版权问题结论相混淆,微软将在其法律文件中对此予以回应。” 但基于这份新解封的文件,事实已清晰表明:微软与OpenAI明知其行为将不可挽回地损害出版行业、该行业雇佣的“数百万民众”,并最终反噬自身产品,却仍为追逐“海量财富”而一意孤行——所谓死亡螺旋,已然成真。 **追踪话题与作者**以在个性化主页获取更多相关资讯,并接收邮件更新。 - 特伦斯·奥布莱恩

相似文章

这起OpenAI法庭故事开始变得难看

Reddit r/artificial

《纽约时报》指控OpenAI误导法庭,声称无法搜索训练数据中的受版权保护材料,但此前曾这样做过并删除了数十亿聊天记录。这起案件引发对AI公司透明度和问责制的担忧。