威胁建模负责人
岗位摘要
开发和维护涵盖所有滥用领域(生物、网络、攻击策划等)的全面威胁模型;针对前沿AI系统可能带来的失控、自我进化及其他对齐风险,开发合理且令人信服的威胁模型;结合技术预见、对抗模拟和新兴趋势进行风险预测
登录后保留你的岗位线索
邮箱登录后可继续查看完整职责、任职要求和原岗位入口,并使用收藏与浏览记录沉淀适合自己的机会。
岗位职责
- 开发和维护涵盖所有滥用领域(生物、网络、攻击策划等)的全面威胁模型
- 针对前沿AI系统可能带来的失控、自我进化及其他对齐风险,开发合理且令人信服的威胁模型
- 结合技术预见、对抗模拟和新兴趋势进行风险预测
- 与技术合作伙伴紧密合作,确保能力评估能够覆盖并应对前沿AI系统可能引发的各种严重风险
- 与生物和网络安全负责人紧密合作,评估现有保障措施的剩余风险,并将威胁模型转化为可操作的缓解设计方案
- 作为思想伙伴,解释高风险缓解措施背后的“原因”和“时机”,帮助利益相关者理解优先级排序背后的逻辑
- 作为连接技术、治理和政策视角的核心节点,协调各方对滥用风险应对策略的优先级、重点和基本原理达成共识
任职要求
- 理解前沿AI系统带来的风险,并熟练掌握AI对齐相关文献
- 在威胁建模、风险分析或对抗性思维(例如安全、国家安全或安全保障领域)方面拥有深厚经验
- 了解AI评估的工作原理,并能将评估结果与能力测试及保障措施充分性联系起来
- 乐于跨技术和政策领域工作,以推动严谨的多学科风险评估
- 能够清晰且有说服力地向技术和非技术受众传达复杂的风险
- 具备系统思维,能够自然预见到二阶风险和连锁风险
登录后查看完整岗位详情
使用邮箱验证码登录后,可查看完整职责、任职要求、原岗位入口,并继续使用收藏和浏览记录。列表摘要保持公开,完整详情用于保护数据质量和降低恶意抓取。