Researcher Misalignment Research New York City
岗位摘要
设计和实施最坏情况演示,使AGI对齐风险对利益相关者具体化,重点关注高风险用例;基于这些演示开发对抗性和系统级评估,推动OpenAI内部的采用;创建自动化工具和基础设施,以扩展自动化红队和压力测试
登录后保留你的岗位线索
邮箱登录后可继续查看完整职责、任职要求和原岗位入口,并使用收藏与浏览记录沉淀适合自己的机会。
岗位职责
- 设计和实施最坏情况演示,使AGI对齐风险对利益相关者具体化,重点关注高风险用例
- 基于这些演示开发对抗性和系统级评估,推动OpenAI内部的采用
- 创建自动化工具和基础设施,以扩展自动化红队和压力测试
- 研究对齐技术的失败模式并提出改进建议
- 发表有影响力的内部或外部论文,改变安全策略或行业实践,旨在具体减少存在性AI风险
- 与工程、研究、政策和法律团队合作,将发现整合到产品保障和治理流程中
- 指导工程师和研究员,培养严谨、以影响为导向的安全工作文化
任职要求
- 日夜思考这些问题,并分享我们构建安全、普遍有益的AGI并与OpenAI宪章对齐的使命
- 在AI红队、安全研究、对抗性ML或相关安全领域有4年以上经验
- 拥有强大的研究记录(出版物、开源项目或高影响力的内部工作),展示在发现和利用系统弱点方面的创造力
- 精通现代ML/AI技术,并能熟练处理大规模代码库和评估基础设施
- 能够清晰地向技术和非技术受众传达信息,将复杂发现转化为可操作的建议
- 喜欢合作,并能推动跨职能项目,涵盖研究、工程和政策
- 拥有计算机科学、机器学习、安全或相关学科的博士、硕士学位或同等经验(非必需但优先考虑)
福利待遇
- 有机会塑造安全实践
登录后查看完整岗位详情
使用邮箱验证码登录后,可查看完整职责、任职要求、原岗位入口,并继续使用收藏和浏览记录。列表摘要保持公开,完整详情用于保护数据质量和降低恶意抓取。