Claude私有聊天记录在Google和Bing搜索结果中曝光
摘要
由于缺少noindex标签,Claude AI的私有聊天记录在Google和Bing搜索结果中曝光,引发隐私担忧。
这一失误表明,阻止网络爬虫将原本私密的AI聊天对话过度公开化是多么棘手。
查看缓存全文
缓存时间: 2026/07/28 06:21
# 私人Claude聊天记录在谷歌和必应搜索结果中曝光
来源:https://www.wired.com/story/private-claude-chats-exposed-in-google-and-bing-search-results/
用户与AI聊天机器人之间发生的事情,并不总是只有你和聊天机器人知道。问问[谷歌](https://www.wired.com/tag/google/)就知道了。
上周末,人们惊讶地发现,一些[Anthropic](https://www.wired.com/tag/anthropic/)[Claude](https://www.wired.com/tag/claude/)聊天记录可以通过网络搜索轻易找到。这个问题最初由一位[Reddit用户](https://www.reddit.com/r/ClaudeAI/comments/1v6fiyj/you_can_view_a_lot_of_shared_conversations_via/)指出,曝光的聊天记录包括用户询问自己应该加入哪个政党、堪萨斯州的律师是否需要在认为自己违反了道德规范时主动报告,以及色情角色扮演等内容。
Claude[允许](https://support.claude.com/en/articles/10593882-share-and-unshare-chats)用户通过创建特定聊天线程的公开URL,与他人分享聊天“快照”。这些URL被主要搜索引擎索引的原因,归结于网站的基本功能、搜索引擎的基本功能,以及当生成式AI加入其中时两者产生的碰撞。
基本上,Anthropic通过所谓的robots.txt文件指示网络爬虫(如谷歌和必应等搜索引擎使用的爬虫)不要索引用户决定与他人分享的聊天记录。根据Wayback Machine上的[快照](https://web.archive.org/web/20250901063709/https://claude.ai/robots.txt),自2025年9月起,Anthropic的robots.txt就已将“分享”的聊天记录设置为禁止网络爬虫访问。
但是,要防止页面被收录到搜索结果中,比预想的要困难得多。
截至本文撰写时,如果你在必应搜索“site:claude.ai/share (http://claude.ai/share)”,仍会看到“约612条结果”。必应在其技术文档中表示,开发者可以使用robots.txt来[阻止](https://www.bing.com/webmasters/help/?topicid=cb7c31ec)搜索引擎的网络爬虫,但网页开发者还应在各个页面上添加一个“noindex”标签。
在Reddit帖子中标记的出现在搜索结果中的一些聊天记录,在我们查看时已被删除;而当你搜索在必应上仍然有效的“share”查询时,谷歌上也不再显示这些结果。在[开发者指南](https://developers.google.com/search/docs/crawling-indexing/robots/intro)中,谷歌表示,如果某个网页从互联网其他地方被链接,并且页面所有者没有在页面上添加特殊的“noindex”HTML标签或在页面响应头中添加“x-robots-tag”,那么谷歌会忽略robots.txt的指令。
WIRED审查了部分曝光的Claude聊天页面,发现它们没有包含“noindex”标签,而必应和谷歌都表示在决定是否索引页面时会考虑该标签。
拥有必应的微软在发布前未提供评论。Anthropic未回复多次的置评请求。
谷歌发言人Ned Adriance告诉WIRED,共享Claude聊天记录被索引是Anthropic的责任。“谷歌或其他搜索引擎都无法控制哪些页面会在网络上公开,而且这些页面已在多个搜索引擎中被索引,”Adriance表示,“我们为网站所有者提供了[明确的控制方法](https://support.google.com/webmasters/answer/7489871),让他们决定页面是否可以被抓取或索引,我们始终尊重这些指令。”
Anthropic没有回答为什么不在共享聊天页面上添加“noindex”标签。
去年9月,Anthropic曾因同样的问题受到批评,当时它告诉[福布斯](https://www.forbes.com/sites/iainmartin/2025/09/08/hundreds-of-anthropic-chatbot-transcripts-showed-up-in-google-search/),它使用robots.txt来提醒爬虫不应访问共享聊天记录。但正如福布斯报道所指出的,这并不能保证搜索引擎不会索引特定网页。
即使robots.txt并不总能阻止页面被搜索引擎索引,AI实验室仍将其用于其他目的。许多实验室向[创作者承诺](https://www.wired.com/story/how-to-stop-your-data-from-being-used-to-train-ai/),只要开发者在他们的robots.txt文件中确保“禁止”某些爬虫,他们的网站就不会被用作AI训练数据,而实验室本身也遵循这一建议。
相似文章
Claude AI 聊天记录出现在谷歌搜索结果中,暴露用户怪异请求
与 Anthropic 的 Claude AI 共享的对话被谷歌暂时索引,暴露了用户的怪异请求并引发隐私担忧。谷歌已删除被索引的聊天记录。
大量用户的Claude聊天记录和创作内容在Google上被曝光
一起数据泄露事件导致Claude用户的聊天记录和创作内容在Google上可被搜索到,暴露了包括API密钥和个人信息在内的隐私数据。Anthropic尚未回应。
提醒:你的Claude共享聊天记录和Artifacts可能已出现在Google上
一起隐私事件导致共享的Claude聊天记录和Artifacts暴露在公开的Google搜索结果中,据报道泄露了包括健康记录和个人信息在内的敏感数据。Anthropic将此次泄露归因于用户公开分享链接,不过该问题现已得到解决。
Google Dork 索引漏洞不仅仅是 Claude 的问题——DeepSeek 也存在同样的问题。
Google Dork 索引漏洞正在影响 Claude 和 DeepSeek 等 AI 聊天机器人,引发安全担忧。
发现一些 Grok 聊天被谷歌索引,笑死我了!!
一位用户发现 Grok 聊天机器人的对话被谷歌搜索索引,凸显了公开分享对话的潜在隐私风险。