研究员,稳健性与安全训练
岗位摘要
开展关于AI安全主题(如RLHF、对抗训练、稳健性等)的前沿研究;在OpenAI的核心模型训练中实施新方法,并在产品中推出安全改进;制定研究方向与策略,使AI系统更安全、更对齐、更稳健
登录后保留你的岗位线索
邮箱登录后可继续查看完整职责、任职要求和原岗位入口,并使用收藏与浏览记录沉淀适合自己的机会。
岗位职责
- 开展关于AI安全主题(如RLHF、对抗训练、稳健性等)的前沿研究
- 在OpenAI的核心模型训练中实施新方法,并在产品中推出安全改进
- 制定研究方向与策略,使AI系统更安全、更对齐、更稳健
- 与跨职能团队(包括T&S、法律、政策及其他研究团队)协调合作,确保产品符合最高安全标准
- 积极评估和理解模型与系统的安全性,识别风险领域并提出缓解策略
任职要求
- 对OpenAI构建安全、普遍有益的AGI使命充满热情,并认同OpenAI章程
- 对AI安全充满热情,致力于使前沿AI模型在现实世界中更安全
- 在AI安全领域(尤其是RLHF、对抗训练、稳健性、公平性与偏见等方面)拥有4年以上经验
- 拥有计算机科学、机器学习或相关领域的博士或其他学位
- 具备AI模型部署安全工作的经验
- 对深度学习研究有深入理解和/或具备强大的工程技能
- 喜欢协作工作环境的团队合作者
登录后查看完整岗位详情
使用邮箱验证码登录后,可查看完整职责、任职要求、原岗位入口,并继续使用收藏和浏览记录。列表摘要保持公开,完整详情用于保护数据质量和降低恶意抓取。