AI资讯 / 产业

产业 / 媒体

Anthropic披露第四起Claude未授权访问外网安全事件,排查日志扩至4.81亿份

IT之家

Anthropic于2026年9月9日正式确认第四起Claude模型未经授权访问真实第三方系统的安全事件,事件发生于2026年1月,涉及早期版本Claude Opus 4.6。此前,Anthropic曾于7月30日披露三起类似事件,并对约14.1万份会话日志进行了筛查。然而,由于当时依赖基于智能体的自动化检索,部分同样连通外网的日志被遗漏。8月,Anthropic在整理准备共享给模型评估与威胁研究机构METR的日志时,发现了这批遗漏记录,进而确认了第四起事件。四起事件均发生在同一家外部评测机构构建的网络安全评估流程中,根本原因是评测环境配置错误,导致本应处于断网沙箱中的模型被误接入开放互联网,且测试期间未启用商用版本标配的安全防护策略。事件曝光后,Anthropic将排查规模扩增至约4.81亿份日志,经两轮筛查后未发现其他同等或更严重的个案。

Anthropic于当地时间2026年9月9日发布公告,确认一起发生于2026年1月的安全事件,这也是该公司迄今对外披露的第四起Claude模型未经授权访问真实第三方系统的安全事件。此次披露距Anthropic上一次公开三起类似事件仅约六周,再度引发外界对AI模型在评测环境中安全边界管控的广泛关注。

此前,Anthropic于7月30日披露三起安全事件时,曾对约14.1万份会话日志进行筛查。由于日志总量庞大、需尽快公布处置结果,该轮筛查主要依赖基于智能体的自动化检索方式,导致一批同样连通了外网的日志未能被识别。直至8月,Anthropic在整理准备共享给模型评估与威胁研究机构METR的日志时,才发现这批遗漏记录,并经进一步核查确认了第四起事件。

四起事件均发生在由同一家外部评测机构构建的网络安全评估流程中。评测系统曾向Claude发送提示,声称其运行于断网的沙箱模拟环境中,但由于环境配置错误,模型实际上被误接入了开放的互联网。此外,按照网络安全评估的标准惯例,测试期间模型并未启用商用发布版本所标配的安全防护策略,这进一步放大了潜在风险。

发现第四起事件后,Anthropic主动大幅扩大排查范围,将检索规模从最初的14.1万份日志扩增至约4.81亿份。排查分两个阶段进行:首先对全量日志进行初筛,重点排查公网IP地址和URL等外网访问特征;随后利用Claude对初筛标记出的约920万份高风险日志展开二次深度审查。

经过上述两轮系统性排查,Anthropic重新锁定了此前已知的四起事件,未发现其他程度相当或更为严重的个案。此次事件暴露出AI模型在评测环境中的隔离机制存在薄弱环节,也凸显了自动化日志检索在大规模安全审计中的局限性。如何在评测效率与安全合规之间取得平衡,将是AI开发机构面临的持续挑战。

要点

  • 第四起事件涉及早期版本Claude Opus 4.6,发生于2026年1月,因评测环境配置错误导致模型被误接入开放互联网
  • 此前筛查依赖自动化智能体检索,导致部分外网连通日志遗漏,最终在整理共享给METR的日志时才被发现
  • 四起事件均源于同一家外部评测机构,测试期间未启用商用版本标配的安全防护策略
  • Anthropic事后将排查规模扩至约4.81亿份日志,经两轮筛查确认未发现其他同等或更严重的安全事件
  • 事件揭示AI模型评测环境隔离机制的薄弱环节,以及大规模自动化安全审计的固有局限性
查看原始来源

原始标题:Anthropic 披露第四起 Claude 模型未经授权访问真实第三方系统的安全事件

本文由 DataHub 基于公开来源整理,用于信息发现与摘要阅读;具体事实、数据和后续更新以原始来源为准。