AI资讯 / 产业

产业 / 媒体

Claude共享对话被谷歌收录,含患者病历与儿童个人信息

TechCrunch AI

上周末,Reddit用户发现只需在谷歌输入「site:claude.ai/share」等搜索指令,即可检索到大量Claude用户的共享对话与Artifacts内容。这些被公开索引的内容涵盖患者病历、临床试验数据、小学生姓名与电话号码,以及标注为「仅限内部」的公司文件。问题根源在于Claude的「分享对话」功能——该功能会生成任何人均可访问的链接,但Anthropic并未像谷歌文档那样阻止搜索引擎对这些链接进行抓取。Anthropic将责任归咎于用户,称链接只有在被发布至论坛或社交媒体等可被爬取的公开场所后,才会出现在搜索结果中。截至周一下午,TechCrunch测试发现相关搜索结果已消失,问题似乎得到修复。这并非Anthropic首次遭遇此类事件,去年谷歌曾索引近600条Claude对话。

上周六,一名Reddit用户率先发现,通过在谷歌搜索框输入特定站点搜索指令,可以直接检索到大量Claude用户的共享对话内容。消息随即在社区扩散,404 Media于周一上午率先进行了正式报道。TechCrunch随后证实,在问题被修复前,搜索结果中确实出现了数量不明的Claude对话与Artifacts——即用户在Claude内部构建的交互式迷你应用和文档。

被公开索引的内容涉及高度敏感的个人与机构信息。据Futurism报道,研究人员在搜索结果中发现了真实患者的详细病历、包含患者姓名的临床试验结果、小学生的姓名与联系电话,以及标注为「仅限内部使用」的公司文件和含有员工个人信息的绩效评估记录。此外,还有代码片段和工作笔记等Artifacts内容遭到暴露。Fortune还报道称,至少一条标注为「由Anthropic分享」的对话中,Claude生成了色情内容,而这明确违反了Anthropic的使用政策。

此次事件的技术根源在于Claude的「分享对话」功能设计。该功能允许用户生成一个链接,持有链接的任何人均可查看对应的对话或项目。Claude界面提示「任何拥有链接的人均可查看」,这一表述暗示该功能主要面向小范围分享场景。然而与谷歌文档等类似功能不同,Anthropic并未主动向搜索引擎屏蔽这些共享链接,也未设置robots.txt等爬取限制,导致一旦链接被发布至公开可见的平台,便可能被搜索引擎收录。

面对外界质疑,Anthropic将责任主要归咎于用户行为。公司发言人Amie Rotherham表示,Anthropic不会主动向搜索引擎提交聊天目录或站点地图,共享链接本身不可被猜测或主动发现,只有当用户将链接发布至可被爬取的公开平台后,才会出现在搜索结果中。谷歌发言人则回应称,搜索引擎无法控制哪些页面被设为公开,并强调谷歌始终遵守网站所有者设置的爬取与索引指令。

这并非Anthropic首次遭遇共享对话被搜索引擎索引的问题。去年,Forbes曾报道数百条Claude对话被搜索引擎收录,谷歌当时估计索引了近600条对话后相关页面才从搜索结果中消失。同年,404 Media还报道了研究人员成功抓取约10万条公开共享的ChatGPT对话的事件,显示此类隐私风险在主流AI平台中普遍存在。目前,用户可前往Claude的「设置→隐私→共享对话」页面,查看并管理自己已设置为公开链接的对话记录。

此次事件再次暴露了AI产品在隐私设计上的深层矛盾:便捷的内容分享功能与用户对数据边界的合理预期之间存在显著落差。当用户将敏感信息输入AI对话时,往往默认这些内容处于私密状态,却未必意识到一次无意间的「分享」操作可能将内容暴露给全球搜索引擎。如何在产品设计层面建立更清晰的隐私默认值,而非仅依赖用户自行管理风险,将是AI平台亟需正视的课题。

要点

  • Claude的「分享对话」功能生成的公开链接,一旦被发布至论坛或社交媒体等可被爬取的平台,即可能被谷歌等搜索引擎收录,导致对话内容对全网可见。
  • 被公开索引的内容涵盖患者病历、儿童个人信息、公司内部文件等高度敏感数据,隐私风险不容忽视。
  • Anthropic将责任归咎于用户主动分享行为,但批评者指出,平台未设置搜索引擎爬取限制是根本设计缺陷。
  • 这是Anthropic在不到一年内第二次遭遇类似问题,去年已有近600条对话被谷歌索引。
  • 用户可通过「设置→隐私→共享对话」路径,检查并撤销已设为公开的Claude对话链接。
查看原始来源

原始标题:PSA: Your Claude shared chats and Artifacts may have ended up on Google

本文由 DataHub 基于公开来源整理,用于信息发现与摘要阅读;具体事实、数据和后续更新以原始来源为准。