AI资讯 / 产业

产业 / 媒体

黑客用Claude开发导弹与无人机,中国AI实验室大规模蒸馏训练数据

The Decoder

Anthropic发布的威胁情报报告覆盖2025年12月至2026年8月,将Claude的滥用行为归纳为七大类:网络攻击、影响力行动、监控、欺诈、生物滥用、常规武器开发以及未经授权的模型蒸馏。报告显示,受影响最深的模型为Haiku、Sonnet和Opus。在网络攻击层面,AI代理已能自动检测恶意软件是否被杀毒软件识别,并在被拦截后自动重写代码,使攻击者得以持续绕过防御。在模型蒸馏层面,阿里巴巴Qwen团队、DeepSeek、Moonshot AI等中国实验室被点名,其中Qwen在两个月内产生逾1.51亿次交互,用于训练自家模型。更为罕见的是,部分实验室将用户请求直接转发至Claude处理,用户却误以为自己在使用本土模型。在监控领域,一名顾问独自借助Claude构建了可监控马里全国2500万张SIM卡的平台。

Anthropic于2026年9月发布的威胁情报报告系统梳理了过去八个月间Claude遭受滥用的全貌。报告将滥用行为分为七类,涵盖网络攻击、影响力行动、监控、欺诈、生物滥用、常规武器开发及未经授权的模型蒸馏。受影响最深的模型为Haiku、Sonnet和Opus,较新的Fable和Mythos模型仅在一起蒸馏案例中出现。Anthropic强调,报告记录的是新型滥用模式,而非常见的低水平攻击。

在网络攻击领域,报告追踪了一个被标记为GTG-20006的俄语黑客组织。该组织构建了一套AI反馈循环:代理程序持续检测恶意软件是否被杀毒工具识别,一旦被拦截便自动重写并重新编译代码,直至绕过检测。这一机制将防御压力完全转移至安全团队一侧,因为攻击者更新代码的速度已远超特征库更新的速度。超过20个目标遭到攻击,包括政府部委、情报机构、大使馆及国防承包商,重点集中于乌克兰和欧洲地区,无人机供应链信息亦在被窃数据之列。

在模型蒸馏方面,Anthropic自今年2月首次披露以来,已新增识别出七家中国实验室的相关行为。其中规模最大的案例来自阿里巴巴Qwen团队(GTG-16005):攻击者通过固定提示词诱导Claude输出推理过程,再将对话记录加工为微调数据,用于训练Qwen 3.5、3.6和3.7系列模型。高峰期单日交互量接近300万次,涉及逾3500个欺诈账户,2026年5月至7月间累计交互超过1.51亿次。

更为罕见的是,部分中国实验室将自家用户的真实请求转发至Claude处理。Moonshot AI(GTG-16002)在十天内通过5380个欺诈账户将近30万条用户请求转发至Anthropic,而用户始终以为自己在使用Kimi模型。DeepSeek(GTG-16001)则通过字符串检测识别来自Claude Code等工具的请求,将特定用户的请求路由至Claude Opus,14天内产生逾1210万次交互。在这些被转发的请求中,Anthropic发现了疑似与解放军相关的用户,其请求内容涉及对成都数百个摄像头监控录像的分析,包括解放军设施外的摄像头画面。

小米(GTG-16008)的做法有所不同:该公司存储了MiMo模型用户的请求与编程会话记录,再将这些对话重放至Claude以生成训练数据,Anthropic未发现Claude的回复被直接提供给小米用户的证据。智谱AI(Z.ai)则通过273个账户在十天内推送逾77万次交互,并使用自动化工具将捕获的推理链转化为可用训练数据,用于训练GLM-5.3模型。商汤科技则通过第三方中间市场购买已捕获的Claude对话记录,并未直接实施蒸馏攻击。

在监控领域,报告记录了一个极端案例:马里一名顾问将Claude作为主要工程力量,独自构建了名为「Lakana 360」的监控平台,可覆盖全国三大运营商约2500万张SIM卡。该平台能够跨SIM卡更换识别声纹、标记使用加密工具和VPN的用户,并将个人信息与国家生物特征公民登记系统关联。Anthropic封禁账户后,仅中断了开发工作,平台本身仍在本地模型上持续运行。报告还记录了伊朗相关单位声称已对6388名伊朗人实施监控与画像的类似案例。

要点

  • AI代理已能自动检测并重写被拦截的恶意软件,使攻击者绕过防御的速度远超安全团队更新特征库的速度,网络攻击的门槛与成本大幅降低。
  • 阿里巴巴Qwen团队在两个月内通过逾3500个欺诈账户产生1.51亿次Claude交互,用于训练自家模型,是迄今记录规模最大的模型蒸馏攻击。
  • Moonshot AI和DeepSeek将真实用户请求秘密转发至Claude处理,用户对此毫不知情,其中部分请求涉及军事敏感内容及俄罗斯国防部数据库凭证。
  • 马里监控平台案例表明,单个行为者借助AI即可独立构建覆盖国家级规模的监控基础设施,且封禁账户无法阻止已部署系统的持续运行。
  • Anthropic的报告揭示,模型蒸馏已从技术研究行为演变为有组织的工业级情报窃取活动,涉及伪造账户网络、盗用信用卡及API密钥等系统性手段。
查看原始来源

原始标题:How hackers used Claude for missiles, drone swarms, and surveillance, while Chinese labs mined it for training data

本文由 DataHub 基于公开来源整理,用于信息发现与摘要阅读;具体事实、数据和后续更新以原始来源为准。