“Google and Reddit do not own the Internet,”网络爬虫公司胜诉后表示

Ars Technica 新闻

摘要

Google和Reddit在一起法庭案件中败诉,他们曾利用DMCA起诉网络爬虫公司SerpApi;法官驳回了诉讼,裁定Google在DMCA下不具备诉讼资格,因为Google不拥有搜索结果中的版权内容。

<p>在上周遭遇重大败诉后,Google已确认不会放弃阻止AI机器人抓取其搜索结果的斗争。而Reddit也奇怪地加入了这一行列。</p> <p>奇怪的是,Google援引《数字千年版权法案》(DMCA),于去年12月起诉了SerpApi。这家搜索巨头指控这家网络爬虫公司规避其反爬技术,然后通过未经授权的“Google Search API”软件服务销售从Google搜索结果中抓取的内容。</p> <p>据Google称,反爬技术的存在是为了保护搜索结果中的版权内容。据称,SerpApi的规避行为威胁到了Google与版权持有人的关系,其中包括一些授权内容给Google以显示在所谓的“knowledge panels”中的人,这些面板会出现在一些知名人物或实体的搜索结果中。</p> <p><a href="https://arstechnica.com/tech-policy/2026/07/google-wont-give-up-odd-war-against-ai-web-scraping-despite-court-loss/">阅读全文</a></p> <p><a href="https://arstechnica.com/tech-policy/2026/07/google-wont-give-up-odd-war-against-ai-web-scraping-despite-court-loss/#comments">评论</a></p>
查看原文
查看缓存全文

缓存时间: 2026/07/27 22:47

# “谷歌和Reddit并不拥有互联网,”网络爬虫公司在胜诉后表示 来源:https://arstechnica.com/tech-policy/2026/07/google-wont-give-up-odd-war-against-ai-web-scraping-despite-court-loss/ ## 围堵开放网络? 专家称,谷歌和Reddit利用DMCA打击网络爬虫的做法令人费解。 在上周经历了一场重大败诉后,谷歌已确认不会放弃阻止AI机器人抓取其搜索结果的斗争。而Reddit也奇怪地加入了这场行动。 去年12月,谷歌援引《数字千年版权法》(DMCA),起诉了SerpApi (https://arstechnica.com/google/2025/12/google-lobs-lawsuit-at-search-result-scraping-firm-serpapi/)。这家搜索巨头指控该网络爬虫公司绕过了其反抓取技术,并通过一款未经授权的“Google Search API”软件服务,将抓取自谷歌搜索结果的内容进行出售。 据谷歌称,部署反抓取技术是为了保护搜索结果中的受版权保护内容。谷歌声称,SerpApi的规避行为威胁到了谷歌与版权持有者之间的关系,其中一些版权持有者授权谷歌将其内容显示在所谓的“知识面板”(https://support.google.com/knowledgepanel/answer/9163198?hl=en)中,这些面板会出现在某些知名人物或实体的搜索结果里。 这是对DMCA的一种奇怪运用,因为谷歌搜索结果本身并不受版权保护。但显然,在Reddit于去年10月提起非常相似的诉讼之后,谷歌受到了鼓舞,开始试探这一法律理论。Reddit在那起诉讼中指控SerpApi和谷歌的竞争对手Perplexity (https://arstechnica.com/tech-policy/2025/10/reddit-sues-to-block-perplexity-from-scraping-google-search-results/)抓取出现在谷歌搜索结果中的Reddit内容。 在一篇博客 (https://blog.google/innovation-and-ai/technology/safety-security/serpapi-lawsuit/)中,谷歌在宣布自己的诉讼时引用了Reddit的案件。谷歌称,提起这起诉讼是“最后的手段”,旨在阻止“恶意抓取”,这种抓取行为侵犯了版权持有者对其内容访问权限的控制权。 具体来说,谷歌声称SerpApi的规避行为违反了其服务条款,使其无法从“数十亿”次机器人搜索中获利,甚至无法抵消其成本。在此之前,Reddit声称SerpApi绕过了两层安全措施:Reddit自身控制其平台上抓取的措施,以及谷歌控制从搜索结果中抓取Reddit内容的措施。 Meredith Rose是非营利公共利益组织Public Knowledge的资深政策顾问,专长于DMCA领域。她告诉Ars,面对过去三年来AI抓取的突然持续增长,谷歌和Reddit似乎“有点在抓任何可用的工具”。虽然他们使用DMCA的方式“很奇怪”——并且“不是法律所设想的用例”——但她表示这并不“令人惊讶”。从历史上看,DMCA一直是快速阻止不受欢迎的内容使用并推动许可谈判的有效工具,因此,考虑到谷歌的目标,求助于DMCA可能是一个显而易见的起点。 但谷歌和Reddit不同寻常的DMCA论点似乎并不占优势。上周,一家法院采取了较为罕见的步骤,在谷歌诉讼的早期阶段就批准了SerpApi的驳回动议 (https://cdn.arstechnica.net/wp-content/uploads/2026/07/Google-v-SerpApi-Order-GRanting-Motion-to-DIsmiss-7-20-26.pdf)。在该案中,法官认为谷歌没有DMCA的诉讼资格来起诉SerpApi,因为谷歌并不拥有搜索结果中的任何内容,也没有证明其代表任何版权持有者行事。 “这种情况并不经常发生,”Rose告诉Ars。“这实际上归结为谷歌没有充分说明它保护的是什么受版权保护的内容。” 这一裁决的时机可能对Reddit不利,因为Reddit上周四就面临SerpApi驳回其诉讼的动议听证会。目前尚不清楚法院将如何裁决该案,但Rose告诉Ars,谷歌的裁决对Reddit来说不是好兆头,因为Reddit不能声称自己是搜索结果中内容的所有者或独家被许可方。 “谷歌案的法官说,‘要拥有根据DMCA提起诉讼的资格,你必须是版权所有者、独家被许可方,或者是部署和制造相关技术保护措施的人,’”Rose告诉Ars。“Reddit不符合其中任何一项。” SerpApi希望这场斗争能尽快结束,它告诉Ars,这场代价高昂的法律战值得坚持到底,以捍卫开放网络。 “底线是,谷歌和Reddit似乎都在试图利用DMCA来围堵开放互联网,方法是追溯性地主张对他们并未创作且并不拥有的内容的控制权,”SerpApi告诉Ars。 ## 谷歌维持战斗的最后机会 尽管Rose同意SerpApi的观点,认为法院批准驳回动议给了SerpApi一场重大胜利,但战斗尚未结束,因为谷歌仍有一条狭窄的前进道路,可以继续其对网络抓取的战争。 谷歌承认搜索结果不能受版权保护,但辩称“知识面板”有时包含谷歌从版权持有者处获得许可的受版权保护内容。如果谷歌能修改其诉状,主张版权持有者直接授权谷歌使用其反抓取技术来防止未经授权访问内容,那么谷歌或许能够阻止SerpApi非常有限的一部分抓取行为。 谷歌发言人José Castañeda告诉Ars,谷歌计划修改诉状,并“很高兴看到法院驳回了SerpApi几乎所有其他试图质疑谷歌诉讼资格的法律论点”。 “我们期待按照法院的邀请提交修改后的诉状,我们仍致力于保护我们的服务和合作伙伴免受未经授权的访问,”Castañeda说。 然而,Rose告诉Ars,谷歌在某种程度上“在这次诉讼以及历史上都把自己逼到了一个有点为难的角落”。 Rose指出,对谷歌来说,声称知识面板“充斥着受版权保护的材料”可能“非常危险”。由于这家搜索巨头并未许可知识框中的所有内容,如果算法创建知识框而未获得许可的行为突然被视为侵权,谷歌可能面临未来的诉讼,Rose说。 “他们必须以某种方式论证,其中有一部分是对受版权保护材料的复制,但唯一属于受版权保护材料复制的部分是他们明确获得许可的那些,”Rose指出。“否则,他们就是在承认自己一直在未经许可的情况下复制材料,这会使他们陷入另一场可能不想面对合理使用之争。” 谷歌有21天的时间来修改其诉状,届时将更清楚地看到它打算如何穿针引线,使其DMCA诉讼得以继续。 ## SerpApi称这场斗争“误入歧途” Reddit未回应Ars的评论请求,但在上周听证会前的一份文件中声称,它已准备好讨论谷歌的败诉对其案件的影响。 也许值得注意的是,SerpApi表示Reddit并未出席法庭。SerpApi在听证会上没有过多评论Reddit的论点,但表示法官似乎专注于法律问题的细微差别。尤其是,法官似乎对Reddit与谷歌的协议是否实际上授权谷歌保护其受版权保护的内容感兴趣。 看来,两个法院都将斗争略微缩小到了这个关键问题,但SerpApi似乎有信心,无论是谷歌还是Reddit都无法证明抓取公开搜索结果会损害版权持有者的利益。 当被问及对谷歌修改诉状计划的评论时,SerpApi告诉Ars,在谷歌发起攻击并声称是为了捍卫出现在搜索结果中的“数十万出版商”之后,继续争论“出现在谷歌知识面板中的文本片段”可能意义不大。 “我们希望谷歌放弃这种对开放互联网的错误攻击,但如果有必要,我们准备捍卫SerpApi、我们的客户和我们的原则,”SerpApi说。 SerpApi告诉Ars,在应对DMCA诉讼期间,其业务持续增长,但其客户——包括Nvidia、Uber和Adobe等科技巨头——在案件拖延期间面临不确定性。 “他们每天依赖SerpApi提供对搜索数据的结构化访问,这始终是一种合法且正当的业务,”SerpApi说。 ## 专家称SerpApi有权捍卫开放网络 SerpApi表示,除了自己的客户,投资于开放网络的人也在思考谷歌胜诉可能带来的影响。 “当然,诉讼极其昂贵且具有破坏性,”SerpApi说。“然而,我们强烈认为,像谷歌和Reddit这样的平台并不拥有互联网,他们武器化DMCA的企图威胁到了所有开放网络的用户。” Rose告诉Ars,虽然SerpApi未必“讨很多人喜欢”,但她认为“从政策角度来看,他们是对的”。 Rose说,自2023年夏天——某种“API末日”开始以来——出版商一直在切断对开放网络的访问,试图找到快速阻止像SerpApi那样大量AI抓取的方法。 “这种对抓取的集体反应”导致了“网络的大量再封闭”,Rose说。令人担忧的是,这不仅阻碍了AI训练工作,还损害了研究、存档、新闻、公共卫生报道以及其他依赖于大规模匿名爬取和自动化抓取的重要工作,Rose说。 SerpApi告诉Ars,它从客户、研究人员和SEO服务提供商那里收到了“压倒性”的支持反馈,支持其应对谷歌和Reddit诉讼的努力。这家网络爬虫公司对法院将批准其针对Reddit的驳回动议感到乐观,并上周庆祝了谷歌的诉讼可能只能在非常有限的诉求上继续进行。 在胜利中,SerpApi警告说,Reddit计划充当“收费员”,要求为其本不拥有的内容支付抓取费用。 “Reddit试图巩固对其用户内容的控制,以便更好地对该内容征税。Reddit并非在保护其用户;Reddit是在为其剥削用户铺路,”SerpApi警告道。 同样,SerpApi指责 (https://storage.courtlistener.com/recap/gov.uscourts.cand.461513/gov.uscourts.cand.461513.22.0.pdf)谷歌要求法院忽视它是“地球上最大的抓取者”这一事实,同时同意切断其他网络爬虫对“100%公开”信息的访问。 对Rose来说,如果斗争结束时公众对数据的访问被切断,那么对在线用户来说就没有赢家。 “这是一个非常紧张的时刻,”Rose说,并承认不仅Reddit和谷歌,网络上许多出版商目前都倾向于使用“工具箱中任何可用的工具来压制”AI抓取。 Rose说,一些出版商可能有经济动机,如谷歌和Reddit,而另一些可能是在保护基础设施或采取道德立场。无论动机是什么,“它正在导致这种更广泛的生态系统范围内的再封闭后果”,她警告道。 尽管SerpApi预期会赢,但Rose指出,DMCA案件的问题在于结果难以预测。 “我非常好奇这在Reddit案中会如何发展,”Rose说。“我总是有点怀疑,因为在一定程度上,一旦进入版权领域,很多法官就会凭感觉判决。” *拥有Ars Technica母公司Condé Nast的Advance Publications是Reddit的最大股东。* Ashley Belanger的照片 (https://arstechnica.com/author/ashleybelanger/) Ashley是Ars Technica的高级政策记者,致力于跟踪新兴政策和新技术的社会影响。她是一位驻芝加哥的记者,拥有20年经验。 15条评论 (https://arstechnica.com/tech-policy/2026/07/google-wont-give-up-odd-war-against-ai-web-scraping-despite-court-loss/#comments) 1. 第一篇文章的列表图:《最受欢迎:Apple TV+《神经漫游者》首支预告片在SDCC亮相》 (https://arstechnica.com/culture/2026/07/first-teaser-for-apple-tvs-neuromancer-debuts-at-sdcc/)

相似文章