一键分享=全网公开?Claude被曝聊天记录可在谷歌直接搜到
从加密货币私钥到身份信息,Reddit 正掀起一场窥探他人的狂欢。
作者丨 樊天骄
编辑丨 郑佳美
2026 年 7 月 26 日,一名 Reddit 用户在社区发帖称,使用谷歌站点检索语法 site:claude.ai/share ,就能批量调出成千上万条 Claude 用户的共享对话记录。雷峰网 (公众号:雷峰网)
用户在 Claude 中点击 “分享” 按钮后,系统会生成一张无需登录、无需身份校验的公开网页,而非仅限指定对象访问的私密链接。
这类页面和互联网上的普通站点页面没有本质区别,具备被搜索引擎爬虫抓取、收录的条件。而绝大多数使用过分享功能的用户,却从未收到过相关风险提示。
帖子发出后迅速在海外社交平台发酵,“分享即公开” 的机制设计争议持续升温,大量超出公众预期的隐私泄露案例也随之接连浮出水面。
随着更多人加入检索,一些极具戏剧性的案例被挖了出来。一时间,搜索其他网友的聊天记录成了社区里的一大乐事。人们搜索着其他用户们的隐私,时不时讨论和感慨,并且乐此不疲。
检索出的内容中,两类信息的风险最为突出。 其一为加密资产信息。有的人就搜到了一位用户的钱包和密码。网友顺着聊天记录找到对应钱包,里面仅有 2.73 美元余额。更令人哭笑不得的是,好心网友想提醒当事人密钥泄露,却翻遍对话也找不到任何联系方式这位用户至今可能都不知道,自己的钱包密钥以这种方式暴露在了全网。
其二为核心身份信息。有用户证实,自己在检索结果中发现了包含社会安全号码(SSN)的完整对话。这类信息一旦流入黑产,可能直接造成身份盗用、金融诈骗等实质性损害。
除此之外,被检索到的内容还涵盖实名从业者的项目文档、法律咨询对话、个人求职简历、成人向内容等多类隐私信息。大量本应在小范围流转的私人内容,就这样毫无屏障地进入了公共搜索引擎的索引库。
01
为什么 robots.txt 拦不住收录?
事件发酵后,有细心网友翻出 Claude 的 robots.txt 文件,发现其中明确标注了 Disallow: /share/* ,也就是规则上禁止爬虫访问 /share 路径。
既然有明确规则,为什么对话还是被搜索引擎收录了?这是本次事件最核心的技术细节。
要厘清这个问题,首先要区分两个概念:抓取和收录:
robots.txt 的作用,是和爬虫约定:不要主动去抓取这个路径下的页面内容。它只能拦住爬虫顺着网站内部链接主动爬取的行为,没有强制约束力,更拦不住搜索引擎把 URL 本身放进搜索结果。
搜索引擎发现一条链接,还有另一条路径:从外部公开网页的外链里发现。只要有用户把 Claude 分享链接发到 Reddit、X、公开论坛、GitHub 文档等任何可被爬虫访问的公开页面,谷歌在爬取那个页面时,就会发现这条 /share 链接。
哪怕 robots.txt 禁止爬虫读取页面正文,谷歌依然会把这个 URL 条目收录进搜索结果,只是不展示页面摘要。真正能让页面彻底不进入搜索结果的,是页面 HTML 中的 noindex 元标签,它会直接向搜索引擎发出指令:不得将此页面纳入索引库。
事发时,Claude 的所有共享页面恰恰缺失了这一关键的 noindex 配置。平台仅靠 robots.txt 做了半程防护,缺少真正生效的反收录机制。据社区网友追溯,2025 年 9 月 Claude 就曾出现过小范围同类收录事件,当时谷歌估算约有不到 600 条对话被索引后移除,但并未推动平台彻底补全防护配置。雷峰网
这个事件的另一个问题是,这些由随机 UUID 组成的分享链接,谷歌究竟是通过什么路径发现的? 有网友明确指出,靠暴力枚举数十亿种字符组合几乎没有可能,核心路径必然是外部链接。主流推测是,部分用户将分享链接发布到了公开论坛、社交平台、开源项目文档等可被爬虫访问的公开页面,谷歌在爬取这些页面时,同步发现了对应的 /share 链接。
也有网友提出,Gmail、Google Chat 等谷歌旗下通讯产品可能是链接来源之一。但该说法仅为社区猜想,目前没有实证支撑。
对于此次事件,Anthropic 似乎也做了紧急补救。用户实测发现,执行 site:claude.ai/share 指令,谷歌已经显示 “未找到匹配文档” 的结果。外界普遍判断,平台紧急为所有共享会话页面补充了 noindex 标签,阻止了新的收录继续发生。
但修复存在天然滞后性:Bing、Brave 等其他搜索引擎的缓存更新有独立周期,已被抓取的历史页面缓存不会立刻消失。
02
OpenAI 与 Grok 的隐私疏漏
事实上,这类索引配置问题,并非 Anthropic 独有。
几年前,ChatGPT 的共享对话功能就爆发过完全一致的隐私设计问题。事发后 OpenAI 虽紧急补全了页面 noindex 配置,并在分享弹窗中增加了风险提示,但其分享机制本身的底层设计并未改变。
如今 Anthropic 出现同类问题,本质是两家头部厂商采用了同一种安全设计思路。 同赛道的 Grok 也曾踩过一模一样的坑。2025 年,Grok 平台数十万条共享对话被谷歌批量收录,引发过同等规模的隐私争议。
虽然事故过后,xAI 从架构层面搭建多层前置防御,比如给所有分享页面强制加上 noindex 标签,同步收紧了全站 robots.txt 的抓取规则,两道防护同时落地,从爬虫抓取和结果收录两个环节都设下明确限制。
这套方案的核心优势,是把防护做在了前面,而非把安全前提寄托在用户的使用习惯上。但从整个行业来看,这类问题的底层设计逻辑并未得到普遍修正。
03
如何补齐索引配置与分享设计的短板
接连在 OpenAI、Anthropic 身上重复上演的同类漏洞,也促使社区开始反思行业通行的产品设计思路。
对话分享功能便于内容传播,能够带动产品增长,因此厂商大多优先保证使用体验;但反索引、分级权限这类隐私防护手段,往往要等到安全事故爆发、舆论发酵之后,才通过临时补丁仓促补上。
不少网友在讨论中呼吁,平台需要从品底层搭建更完备的防护体系。普通用户大多不懂 noindex、网页爬虫缓存这类网络技术,很难意识到分享链接暗藏风险。
从产品技术的角度看,目前可行的优化思路相对成熟,实现成本也可控,其中最基础的一层,是将 noindex 设为分享页面的默认配置,从源头阻断搜索引擎的收录路径。
在此基础上,也可以通过权限设计进一步收窄风险,比如增加登录访问校验,支持用户为链接设置访问密码、自定义有效时长,让分享的范围和时效更可控。
同时在分享操作旁给出更直白的风险提示,不用晦涩术语,直接说明链接具备被搜索引擎收录的可能,让用户在点击前对公开属性有清晰认知。
这些调整不需要大幅改动产品架构,却能有效拉平用户的隐私预期与产品实际机制之间的差距。雷峰网
参考链接:
https://www.reddit.com/r/ClaudeAI/comments/1v6fiyj/you_can_view_a_lot_of_shared_conversations_via/
https://x.com/alex_prompter/status/2081327819800576085
主题:用户