这些曝光的对话内容触目惊心:加密货币钱包私钥、API访问凭证、律师讨论潜在道德违规的内部策略、带有员工姓名和邮箱的公司文件、个人简历等私密信息一览无余。
需要明确指出的是,这并非Anthropic服务器被黑客攻破,而是其“共享”功能的正常工作机制与搜索引擎配置疏漏共同作用的结果。
Anthropic本意是为共享页面设置了两道防护,却因配置逻辑的冲突而导致失效:
robots.txt文件中添加了 Disallow: /share/* 指令,明确告知搜索引擎爬虫不要访问/share/路径下的页面。X-Robots-Tag: noindex,指示搜索引擎即使爬取到该页面,也不应将其加入索引。关键冲突点:因为robots.txt禁止了谷歌爬虫(Googlebot)访问这些页面,爬虫压根无法读取页面内容,自然也看不到那个至关重要的noindex头部。然而,当用户将这些共享链接发布到社交媒体、论坛等其他公开网站上时,谷歌爬虫可以通过这些外部网站“发现”该URL。由于爬虫被robots.txt挡在门外,无法获取页面内容来判断是否需要索引,但它仍然可以基于外部链接的信息,将这条URL“收录”进搜索引擎(但不会显示摘要文字)。最终,robots.txt的屏蔽指令反而让noindex标签形同虚设。
| 公司 | 事件 | 规模 | 关键差异 |
|---|---|---|---|
| OpenAI (ChatGPT) | 2023–2025年:用户分享的ChatGPT链接被谷歌索引。谷歌估计有数十万条对话记录被曝光。 | 多家AI聊天机器人平台共约14.3万条对话 | OpenAI最初未对共享链接使用noindex或robots.txt屏蔽。 |
| xAI (Grok) | 2025年:Grok共享对话同样出现在谷歌搜索结果中。 | 数十万条 | 模式相似——共享链接公开可访问并被爬取。 |
| Anthropic (前次事件) | 2025年9月:Forbes报道称Anthropic成为第三家聊天记录泄露的AI公司。但与OpenAI和xAI不同,Anthropic声称已屏蔽爬虫,然而页面仍然泄露。 | 数百条对话记录 | 这是“二进宫”。同一类问题在声称修复后再次发生。 |
核心模式:在这三起事件中,根本原因都是AI公司的“分享”功能生成了公开的、可猜测的URL,而用户将这些链接发布在开放网络上,最终被搜索引擎索引。Anthropic 2025年的事件本质上是同样的问题。
site:查询发现。Google此前曾估计,在上一次事件中,它在被删除前索引了“不到600条”Claude对话。目前情况仍在变化中——截至报道时,Anthropic尚未公开回应此事。
Anthropic官方帮助中心提供了以下步骤,中文用户可以按照以下方法操作:
查看你的共享聊天:
取消共享(撤回)一个对话:
彻底删除一个对话:
特别注意:取消共享或删除对话不会自动将其从搜索引擎缓存中移除。你可能还需要单独向谷歌、必应和Brave提交删除请求,以清除已被索引的URL。