返回岗位列表

Anthropic

网络安全危害技术政策经理

地点:远程 薪资:$320,000-$405,000 日期:2026-01-29

岗位摘要

领导并发展专注于网络威胁建模和评估框架的技术专家团队;设计并监督执行能力评估('evals'),以评估新模型的网络相关能力;创建全面的网络威胁模型,包括攻击向量、利用链、前兆识别和武器化技术

岗位职责

  • 领导并发展专注于网络威胁建模和评估框架的技术专家团队
  • 设计并监督执行能力评估('evals'),以评估新模型的网络相关能力
  • 创建全面的网络威胁模型,包括攻击向量、利用链、前兆识别和武器化技术
  • 制定并迭代使用政策,以管理我们的模型在与网络危害相关的新兴能力和用例方面的负责任使用
  • 担任网络危害领域的主要专家,就威胁态势和缓解策略为跨职能团队提供建议
  • 与内部和外部威胁建模专家密切合作,为安全系统开发训练数据,并与机器学习工程师合作训练这些系统,优化对抗性攻击的鲁棒性和对合法安全研究人员的低误报率
  • 分析流量中的安全系统性能,识别差距并提出改进建议
  • 定期审查现有政策和执行系统,以识别和解决与网络安全风险相关的差距和模糊之处
  • 针对不断演变的网络威胁和产品表面,开发严格的安全保障压力测试
  • 与研究、产品、政策、安全团队和前沿红队合作,确保网络安全贯穿模型开发生命周期
  • 将网络安全领域知识转化为可操作的安全要求和清晰阐述的政策
  • 为外部沟通做出贡献,包括与网络安全相关的模型卡、博客文章和政策文件
  • 监控新兴技术和威胁态势,了解其可能带来的新风险和缓解策略,并战略性地加以解决
  • 指导和发展团队成员,培养技术卓越和负责任AI开发的文化

任职要求

  • 拥有计算机科学、网络安全或相关技术领域的硕士或博士学位,或在进攻性或防御性网络安全方面具备同等专业经验
  • 5年以上网络安全实践经验,在漏洞研究、漏洞利用开发、网络安全、恶意软件分析等领域具有深厚专业知识