AI资讯 / 产业

产业 / 媒体

Anthropic向监管机构和媒体开放Claude文本水印检测API

The Decoder

Anthropic正式推出水印验证API,允许经批准的机构检测文本中是否含有Claude的数字水印。根据欧盟《人工智能法案》的规定,自2025年8月2日起,新版Claude模型须在文本输出中嵌入隐形水印。目前可申请访问该API的机构包括监管机构、执法部门、媒体机构、事实核查组织、独立研究人员、教育机构及欧盟公民社会团体,同时也向有合规需求的企业开放。该系统基于谷歌SynthID文本方法构建,通过调整词语选择的随机性来生成统计上可检测的模式,Anthropic表示这一水印在经过部分编辑后仍可能保留。然而,批评者认为此举可能影响文本质量,并在合同禁止使用AI的场景中引发透明度风险。

Anthropic近日推出水印验证API,向监管机构、媒体、事实核查机构及研究人员等经批准的组织开放,允许其检测特定文本是否携带Claude的数字水印。这一举措直接回应了欧盟《人工智能法案》的合规要求——该法案自2025年8月2日起正式要求新版Claude模型在所有文本输出中嵌入隐形水印。Anthropic表示,未来将逐步扩大API的访问范围。

在技术实现上,该系统以谷歌的SynthID文本水印方法为基础,通过对词语选择随机性的细微调整,在文本中形成统计上可被识别的特定模式。Anthropic声称,这种水印在文本经过一定程度的编辑修改后仍可能得以保留,可靠性远高于Pangram等传统AI检测工具。此外,Anthropic强调水印不包含任何用户数据,也不会影响文本的质量或内容。

然而,批评者对上述说法持保留态度。有观点认为,如果Claude在生成文本时依据水印密钥而非语义来选择同义词,文本质量将不可避免地受到影响。这一担忧指向了水印机制与语言模型自然生成逻辑之间潜在的内在矛盾——为了可检测性而干预词语选择,可能使输出结果偏离最优表达。

法律行业媒体《Artificial Lawyer》进一步指出了透明度层面的风险。在合同明确禁止使用AI的场景下,可被检测的AI文本指纹可能给当事方带来法律麻烦;在费用谈判等商业场景中,AI使用痕迹的暴露也可能引发争议。不过该媒体同时预测,在大多数实际应用场景中,水印的影响相对有限,不会造成实质性危害。

此次Anthropic开放水印检测API,是AI行业在监管压力下推进透明度建设的一个缩影。随着欧盟AI法案的全面落地,AI生成内容的标识与溯源问题将成为各大模型厂商必须正面应对的合规课题。水印技术能否在保障检测可靠性的同时兼顾文本质量,仍有待市场和监管实践的进一步检验。

要点

  • Anthropic推出水印验证API,监管机构、媒体、事实核查机构等经批准组织可申请访问,用于检测文本是否由Claude生成
  • 欧盟《人工智能法案》自2025年8月起要求新版Claude模型在文本输出中强制嵌入隐形水印,此举直接驱动了该API的推出
  • 水印系统基于谷歌SynthID方法改进,通过调整词语选择随机性形成可统计检测的模式,声称在部分编辑后仍可保留
  • 批评者担忧水印机制会干扰词语选择逻辑,影响文本质量,并在禁止AI使用的合同场景中引发透明度和法律风险
查看原始来源

原始标题:Anthropic opens Claude AI text detection to regulators, media, fact-checkers, and others

本文由 DataHub 基于公开来源整理,用于信息发现与摘要阅读;具体事实、数据和后续更新以原始来源为准。