返回岗位列表

OpenAI

威胁建模负责人

地点:美国 薪资:薪资未公开 日期:2025-11-25

岗位摘要

开发和维护涵盖所有滥用领域(生物、网络、攻击策划等)的全面威胁模型;针对前沿AI系统可能带来的失控、自我进化及其他对齐风险,开发合理且令人信服的威胁模型;结合技术预见、对抗模拟和新兴趋势进行风险预测

岗位职责

  • 开发和维护涵盖所有滥用领域(生物、网络、攻击策划等)的全面威胁模型
  • 针对前沿AI系统可能带来的失控、自我进化及其他对齐风险,开发合理且令人信服的威胁模型
  • 结合技术预见、对抗模拟和新兴趋势进行风险预测
  • 与技术合作伙伴紧密合作,确保能力评估能够覆盖并应对前沿AI系统可能引发的各种严重风险
  • 与生物和网络安全负责人紧密合作,评估现有保障措施的剩余风险,并将威胁模型转化为可操作的缓解设计方案
  • 作为思想伙伴,解释高风险缓解措施背后的“原因”和“时机”,帮助利益相关者理解优先级排序背后的逻辑
  • 作为连接技术、治理和政策视角的核心节点,协调各方对滥用风险应对策略的优先级、重点和基本原理达成共识

任职要求

  • 理解前沿AI系统带来的风险,并熟练掌握AI对齐相关文献
  • 在威胁建模、风险分析或对抗性思维(例如安全、国家安全或安全保障领域)方面拥有深厚经验
  • 了解AI评估的工作原理,并能将评估结果与能力测试及保障措施充分性联系起来
  • 乐于跨技术和政策领域工作,以推动严谨的多学科风险评估
  • 能够清晰且有说服力地向技术和非技术受众传达复杂的风险
  • 具备系统思维,能够自然预见到二阶风险和连锁风险