返回岗位列表

OpenAI

Researcher Misalignment Research New York City

地点:美国 薪资:$380K-$460K 日期:2026-01-29

岗位摘要

设计和实施最坏情况演示,使AGI对齐风险对利益相关者具体化,重点关注高风险用例;基于这些演示开发对抗性和系统级评估,推动OpenAI内部的采用;创建自动化工具和基础设施,以扩展自动化红队和压力测试

岗位职责

  • 设计和实施最坏情况演示,使AGI对齐风险对利益相关者具体化,重点关注高风险用例
  • 基于这些演示开发对抗性和系统级评估,推动OpenAI内部的采用
  • 创建自动化工具和基础设施,以扩展自动化红队和压力测试
  • 研究对齐技术的失败模式并提出改进建议
  • 发表有影响力的内部或外部论文,改变安全策略或行业实践,旨在具体减少存在性AI风险
  • 与工程、研究、政策和法律团队合作,将发现整合到产品保障和治理流程中
  • 指导工程师和研究员,培养严谨、以影响为导向的安全工作文化

任职要求

  • 日夜思考这些问题,并分享我们构建安全、普遍有益的AGI并与OpenAI宪章对齐的使命
  • 在AI红队、安全研究、对抗性ML或相关安全领域有4年以上经验
  • 拥有强大的研究记录(出版物、开源项目或高影响力的内部工作),展示在发现和利用系统弱点方面的创造力
  • 精通现代ML/AI技术,并能熟练处理大规模代码库和评估基础设施
  • 能够清晰地向技术和非技术受众传达信息,将复杂发现转化为可操作的建议
  • 喜欢合作,并能推动跨职能项目,涵盖研究、工程和政策
  • 拥有计算机科学、机器学习、安全或相关学科的博士、硕士学位或同等经验(非必需但优先考虑)

福利待遇

  • 有机会塑造安全实践