返回岗位列表

OpenAI

自动化红队研究员

地点:美国 薪资:薪资未公开 日期:2026-07-20

岗位摘要

负责自动化红队在灾难性风险领域的研究和技术方向,初始重点包括:自动化分类器越狱发现(网络和生物)、自动化生物威胁开发诱导(最坏可行规划提升)、思维链监控规避探测(及相关的失控评估)

岗位职责

  • 负责自动化红队在灾难性风险领域的研究和技术方向,初始重点包括:自动化分类器越狱发现(网络和生物)、自动化生物威胁开发诱导(最坏可行规划提升)、思维链监控规避探测(及相关的失控评估)
  • 与垂直风险团队(网络、生物、失控)紧密合作,定义威胁模型、确定优先级并落实缓解措施
  • 与分类器团队合作,将发现的攻击转化为训练数据、评估和可衡量的鲁棒性提升
  • 与产品、工程和安全利益相关者合作,确保自动化红队的输出在操作上有用

任职要求

  • 对AI安全有强烈兴趣,并致力于减少现实世界的灾难性风险
  • 喜欢(负责任地)破坏系统,能从发现奇怪、高严重性的故障模式并将其转化为具体修复中获得能量
  • 具备强大的应用研究直觉,特别是在评估方面:擅长设计可重复、可解释且难以欺骗的实验
  • 拥有LLM和智能体的实践经验,包括多轮行为、工具使用以及模型适应约束的方式
  • 能够构建可扩展的自动化系统,而不仅仅是原型——能将红队想法转化为持续运行并产生高信号输出的管道
  • 具备扎实的软件工程基础(数据结构、算法、测试纪律),能在接近生产的环境中有效工作
  • 以威胁模型和激励机制思考,自然地问“攻击者下一步会做什么?”或“这在压力下会如何失败?”
  • 能将混乱的发现转化为行动,与研究人员、工程师、产品和政策清晰沟通,并推动就优先修复什么达成一致
  • 注重效率和优先级,乐于对低杠杆工作说“不”,专注于影响风险的关键点
  • 加分项:在对抗性机器学习、安全研究/红队、滥用预防系统或大规模评估基础设施方面有经验

福利待遇

  • 参与前沿AI安全研究,对全球安全产生深远影响
  • 与顶尖的研究人员、工程师和产品团队合作
  • 在快节奏、高影响力的环境中工作,推动公司和社会进步
  • 有机会将研究成果转化为实际生产改进