登录

一键分享=全网公开?Claude被曝聊天记录可在谷歌直接搜到


速读:的作用,是和爬虫约定:不要主动去抓取这个路径下的页面内容。 有的人就搜到了一位用户的钱包和密码。
2026年07月31日 19:16

从加密货币私钥到身份信息,Reddit 正掀起一场窥探他人的狂欢。

    作者丨 樊天骄

    编辑丨 郑佳美

2026 年 7 月 26 日,一名 Reddit 用户在社区发帖称,使用谷歌站点检索语法  site:claude.ai/share ,就能批量调出成千上万条 Claude 用户的共享对话记录。雷峰网 (公众号:雷峰网)

用户在 Claude 中点击 “分享” 按钮后,系统会生成一张无需登录、无需身份校验的公开网页,而非仅限指定对象访问的私密链接。

这类页面和互联网上的普通站点页面没有本质区别,具备被搜索引擎爬虫抓取、收录的条件。而绝大多数使用过分享功能的用户,却从未收到过相关风险提示。

帖子发出后迅速在海外社交平台发酵,“分享即公开” 的机制设计争议持续升温,大量超出公众预期的隐私泄露案例也随之接连浮出水面。

随着更多人加入检索,一些极具戏剧性的案例被挖了出来。一时间,搜索其他网友的聊天记录成了社区里的一大乐事。人们搜索着其他用户们的隐私,时不时讨论和感慨,并且乐此不疲。

检索出的内容中,两类信息的风险最为突出。 检索出的内容中,两类信息的风险最为突出。 其一为加密资产信息。有的人就搜到了一位用户的钱包和密码。网友顺着聊天记录找到对应钱包,里面仅有 2.73 美元余额。更令人哭笑不得的是,好心网友想提醒当事人密钥泄露,却翻遍对话也找不到任何联系方式这位用户至今可能都不知道,自己的钱包密钥以这种方式暴露在了全网。

其二为核心身份信息。有用户证实,自己在检索结果中发现了包含社会安全号码(SSN)的完整对话。这类信息一旦流入黑产,可能直接造成身份盗用、金融诈骗等实质性损害。

除此之外,被检索到的内容还涵盖实名从业者的项目文档、法律咨询对话、个人求职简历、成人向内容等多类隐私信息。大量本应在小范围流转的私人内容,就这样毫无屏障地进入了公共搜索引擎的索引库。

01

为什么 robots.txt 拦不住收录?

事件发酵后,有细心网友翻出 Claude 的 robots.txt 文件,发现其中明确标注了  Disallow: /share/* ,也就是规则上禁止爬虫访问 /share 路径。

既然有明确规则,为什么对话还是被搜索引擎收录了?这是本次事件最核心的技术细节。

要厘清这个问题,首先要区分两个概念:抓取和收录:

robots.txt  的作用,是和爬虫约定:不要主动去抓取这个路径下的页面内容。它只能拦住爬虫顺着网站内部链接主动爬取的行为,没有强制约束力,更拦不住搜索引擎把 URL 本身放进搜索结果。

搜索引擎发现一条链接,还有另一条路径:从外部公开网页的外链里发现。只要有用户把 Claude 分享链接发到 Reddit、X、公开论坛、GitHub 文档等任何可被爬虫访问的公开页面,谷歌在爬取那个页面时,就会发现这条 /share 链接。

哪怕 robots.txt 禁止爬虫读取页面正文,谷歌依然会把这个 URL 条目收录进搜索结果,只是不展示页面摘要。真正能让页面彻底不进入搜索结果的,是页面 HTML 中的 noindex 元标签,它会直接向搜索引擎发出指令:不得将此页面纳入索引库。

事发时,Claude 的所有共享页面恰恰缺失了这一关键的 noindex 配置。平台仅靠 robots.txt 做了半程防护,缺少真正生效的反收录机制。据社区网友追溯,2025 年 9 月 Claude 就曾出现过小范围同类收录事件,当时谷歌估算约有不到 600 条对话被索引后移除,但并未推动平台彻底补全防护配置。雷峰网

这个事件的另一个问题是,这些由随机 UUID 组成的分享链接,谷歌究竟是通过什么路径发现的? 这个事件的另一个问题是,这些由随机 UUID 组成的分享链接,谷歌究竟是通过什么路径发现的? 有网友明确指出,靠暴力枚举数十亿种字符组合几乎没有可能,核心路径必然是外部链接。主流推测是,部分用户将分享链接发布到了公开论坛、社交平台、开源项目文档等可被爬虫访问的公开页面,谷歌在爬取这些页面时,同步发现了对应的 /share 链接。

也有网友提出,Gmail、Google Chat 等谷歌旗下通讯产品可能是链接来源之一。但该说法仅为社区猜想,目前没有实证支撑。

对于此次事件,Anthropic 似乎也做了紧急补救。用户实测发现,执行  site:claude.ai/share  指令,谷歌已经显示 “未找到匹配文档” 的结果。外界普遍判断,平台紧急为所有共享会话页面补充了  noindex  标签,阻止了新的收录继续发生。

但修复存在天然滞后性:Bing、Brave 等其他搜索引擎的缓存更新有独立周期,已被抓取的历史页面缓存不会立刻消失。

02

OpenAI 与 Grok 的隐私疏漏

事实上,这类索引配置问题,并非 Anthropic 独有。

几年前,ChatGPT 的共享对话功能就爆发过完全一致的隐私设计问题。事发后 OpenAI 虽紧急补全了页面 noindex 配置,并在分享弹窗中增加了风险提示,但其分享机制本身的底层设计并未改变。

如今 Anthropic 出现同类问题,本质是两家头部厂商采用了同一种安全设计思路。 如今 Anthropic 出现同类问题,本质是两家头部厂商采用了同一种安全设计思路。 如今 Anthropic 出现同类问题,本质是两家头部厂商采用了同一种安全设计思路。 同赛道的 Grok 也曾踩过一模一样的坑。2025 年,Grok 平台数十万条共享对话被谷歌批量收录,引发过同等规模的隐私争议。

虽然事故过后,xAI 从架构层面搭建多层前置防御,比如给所有分享页面强制加上 noindex 标签,同步收紧了全站 robots.txt 的抓取规则,两道防护同时落地,从爬虫抓取和结果收录两个环节都设下明确限制。

这套方案的核心优势,是把防护做在了前面,而非把安全前提寄托在用户的使用习惯上。但从整个行业来看,这类问题的底层设计逻辑并未得到普遍修正。

03

如何补齐索引配置与分享设计的短板

接连在 OpenAI、Anthropic 身上重复上演的同类漏洞,也促使社区开始反思行业通行的产品设计思路。

对话分享功能便于内容传播,能够带动产品增长,因此厂商大多优先保证使用体验;但反索引、分级权限这类隐私防护手段,往往要等到安全事故爆发、舆论发酵之后,才通过临时补丁仓促补上。

不少网友在讨论中呼吁,平台需要从品底层搭建更完备的防护体系。普通用户大多不懂 noindex、网页爬虫缓存这类网络技术,很难意识到分享链接暗藏风险。

从产品技术的角度看,目前可行的优化思路相对成熟,实现成本也可控,其中最基础的一层,是将 noindex 设为分享页面的默认配置,从源头阻断搜索引擎的收录路径。

在此基础上,也可以通过权限设计进一步收窄风险,比如增加登录访问校验,支持用户为链接设置访问密码、自定义有效时长,让分享的范围和时效更可控。

同时在分享操作旁给出更直白的风险提示,不用晦涩术语,直接说明链接具备被搜索引擎收录的可能,让用户在点击前对公开属性有清晰认知。

这些调整不需要大幅改动产品架构,却能有效拉平用户的隐私预期与产品实际机制之间的差距。雷峰网

参考链接:

https://www.reddit.com/r/ClaudeAI/comments/1v6fiyj/you_can_view_a_lot_of_shared_conversations_via/

https://x.com/alex_prompter/status/2081327819800576085

主题:用户