返回岗位列表

OpenAI

研究员,稳健性与安全训练

地点:美国 薪资:$310K-$460K 日期:2026-01-29

岗位摘要

开展关于AI安全主题(如RLHF、对抗训练、稳健性等)的前沿研究;在OpenAI的核心模型训练中实施新方法,并在产品中推出安全改进;制定研究方向与策略,使AI系统更安全、更对齐、更稳健

岗位职责

  • 开展关于AI安全主题(如RLHF、对抗训练、稳健性等)的前沿研究
  • 在OpenAI的核心模型训练中实施新方法,并在产品中推出安全改进
  • 制定研究方向与策略,使AI系统更安全、更对齐、更稳健
  • 与跨职能团队(包括T&S、法律、政策及其他研究团队)协调合作,确保产品符合最高安全标准
  • 积极评估和理解模型与系统的安全性,识别风险领域并提出缓解策略

任职要求

  • 对OpenAI构建安全、普遍有益的AGI使命充满热情,并认同OpenAI章程
  • 对AI安全充满热情,致力于使前沿AI模型在现实世界中更安全
  • 在AI安全领域(尤其是RLHF、对抗训练、稳健性、公平性与偏见等方面)拥有4年以上经验
  • 拥有计算机科学、机器学习或相关领域的博士或其他学位
  • 具备AI模型部署安全工作的经验
  • 对深度学习研究有深入理解和/或具备强大的工程技能
  • 喜欢协作工作环境的团队合作者