AI资讯 / 产业

产业 / 媒体

Anthropic 大幅放宽 Fable 5 生物学过滤器,但病毒学与毒理学限制依然保留

The Decoder

Anthropic 近日对其旗舰模型 Fable 5 的生物学安全过滤器进行了重大调整,将误报率削减了约85%。此前,几乎所有涉及生物学的查询都会被拦截并转发至能力较弱的 Opus 5,这一做法引发了科学界的强烈批评。经过此次更新,用户现在可以用 Fable 5 处理解读实验室结果、理解症状、回答医学问题等大量日常生物学任务。与此同时,Anthropic 对病毒学、毒理学和分子设计等「双重用途」敏感领域的限制依然保留,理由是这些领域存在被恶意行为者利用的现实风险。公司还表示正在建立专项访问计划,以便研究人员未来能够使用受限功能。Anthropic 的核心逻辑在于:生物风险一旦释放便难以收回,其危害远比网络攻击更难遏制。

Anthropic 宣布对 Fable 5 的生物学安全分类器进行重要升级,将误报率降低了约85%。在此之前,模型几乎会将所有生物学相关查询一律拦截,并自动转发至能力更为有限的 Opus 5 模型处理。这一过于保守的策略让众多科研人员和医疗从业者深感不满,认为旗舰模型的实用价值因此大打折扣。

经过此次调整,用户现在可以直接使用 Fable 5 完成大量生物医学任务,包括解读实验室检测结果、理解疾病症状、回答医学相关问题等。新的分类器能够更精准地区分良性查询与潜在高风险请求,让绝大多数日常生物学问题顺利通过,同时继续拦截真正敏感的内容。

然而,Anthropic 对病毒学、毒理学和分子设计等所谓「双重用途」领域的限制并未解除。公司认为,在这些特定领域,Fable 5 的能力可能为恶意行为者提供在其他途径无法获得的关键信息,因此必须维持更严格的管控。与此同时,Anthropic 正在开发专项访问计划,以便经过审核的合法研究人员未来能够使用这些受限功能。

Anthropic 坚持保留部分限制的核心逻辑,在于生物风险与网络安全风险之间存在本质差异。网络攻击可以通过关闭系统、打补丁等方式加以遏制,但一旦危险病毒被释放,便无法像关闭服务器那样将其「下线」,而相应的对抗措施往往需要数月乃至数年才能研发完成。

多项独立研究和机构评估支持了 Anthropic 的这一判断。美国情报机构的分析、对 ChatGPT 中涉及生化武器指令请求的审查、多位研究人员联合发出的警告,以及斯坦福大学利用 AI 设计全合成病毒的项目,均表明 AI 辅助生物威胁并非杞人忧天,而是需要认真对待的现实风险。

此次调整标志着 Anthropic 在 AI 安全策略上的一次重要校准:在维护核心安全底线的前提下,努力减少对合法用户的误伤。如何在开放性与安全性之间找到动态平衡,将是整个 AI 行业在生物医学等高风险领域持续面临的核心挑战。

要点

  • Fable 5 生物学安全过滤器的误报率下降约85%,科学家和医疗用户可以更顺畅地使用旗舰模型处理日常生物医学问题
  • 病毒学、毒理学和分子设计等双重用途敏感领域的限制依然保留,Anthropic 认为这些领域的滥用风险不可接受
  • Anthropic 正在建立专项访问计划,经审核的合法研究人员未来有望获得受限功能的使用权限
  • 多项独立研究证实 AI 辅助生物威胁的现实性,为 Anthropic 维持部分护栏提供了外部依据
  • 此次调整体现了 AI 安全策略从「一刀切」向「精准分级」演进的趋势
查看原始来源

原始标题:Anthropic loosens Fable 5's biology restrictions but keeps the guardrails on for virology and toxicology

本文由 DataHub 基于公开来源整理,用于信息发现与摘要阅读;具体事实、数据和后续更新以原始来源为准。