Claude共享对话遭谷歌索引,敏感数据大规模暴露

近日,一条来自Reddit的线索揭开了令人不安的事实:人工智能助手Claude的数百条共享对话链接,竟然被谷歌搜索引擎公开收录并可供任意浏览。这些未被保护的页面里,藏着从个人隐私到企业机密的各类敏感信息。

泄露内容触目惊心

通过简单的谷歌搜索,任何人都能直接访问这些本应受控的对话记录。暴露的信息类型包括:

  • 加密资产密钥:完整的加密钱包助记词(恢复短语),一旦获取即可完全控制对应资产。
  • 个人身份信息:疑似社会安全号码(SSN)等高度敏感的个人数据。
  • 内部商业文档:涉及法律策略的讨论、未公开的产品路线图,甚至包含员工姓名的详细薪资表。
  • 企业运营数据:内部客户关系管理系统的聊天记录导出文件。

安全漏洞根源何在?

问题的核心在于一个基础的技术疏漏。虽然Anthropic在robots.txt文件中设置了规则,试图阻止搜索引擎爬虫直接抓取Claude共享页面的URL,但这并非万无一失。

当用户将生成的共享链接发布到公开的博客、论坛或社交媒体后,谷歌爬虫依然可以通过这些外部网站发现并索引目标页面。而Claude的共享页面本身缺少关键的noindex元标签,这个标签本应明确告知搜索引擎“不要将此页纳入搜索结果”。正是这个缺失的指令,导致了此次大规模的信息泄露。

影响范围超出对话

此次暴露的不仅仅是文本对话。Claude的“Artifacts”功能——允许用户直接在对话中创建并共享应用程序原型、数据仪表盘或金融分析工具——也受到同样问题的影响。这意味着用户用AI构建的、可能包含真实业务逻辑或数据的工具,也曾面临公开风险。

应对与残留风险

在问题被公开报告后,Anthropic于7月26日前迅速采取了行动,为共享页面配置了正确的noindex标签。谷歌随后开始从其搜索结果中移除这些链接。

然而,风险并未完全消除:

  • 微软的Bing搜索引擎在一段时间内仍可搜到部分历史链接。
  • 更令人担忧的是,已有第三方在GitHub上建立了一个存档仓库,保存了453条Claude对话和519条Grok对话,总计超过1.1万条明文消息。这些数据已被独立于原平台保存下来。

此次事件为AI服务提供商和用户同时敲响了警钟。对于平台而言,任何用户生成内容的分享功能都必须经过严格的安全审计,特别是防范“间接索引”这类隐蔽风险。对于用户,则需清醒认识到:将AI助手用于处理高度敏感信息时,即使使用“分享”功能,也可能存在未知的传播风险。