高级研究员 - 人工智能安全与对抗测试
岗位摘要
设计并实施最坏情况演示,使AGI对齐风险对利益相关者具体化,重点关注高风险用例;基于这些演示,开发对抗性和系统级评估,并在OpenAI内部推动其采用;创建自动化工具和基础设施,以扩展自动化红队测试和压力测试的规模
登录后保留你的岗位线索
邮箱登录后可继续查看完整职责、任职要求和原岗位入口,并使用收藏与浏览记录沉淀适合自己的机会。
岗位职责
- 设计并实施最坏情况演示,使AGI对齐风险对利益相关者具体化,重点关注高风险用例
- 基于这些演示,开发对抗性和系统级评估,并在OpenAI内部推动其采用
- 创建自动化工具和基础设施,以扩展自动化红队测试和压力测试的规模
- 研究对齐技术的失效模式并提出改进方案
- 发表有影响力的内部或外部论文,以改变安全策略或行业实践,目标是切实降低存在性AI风险
- 与工程、研究、政策和法律团队合作,将研究发现整合到产品安全措施和治理流程中
- 指导工程师和研究人员,培养严谨、注重影响力的安全工作文化
任职要求
- 日夜思考这些问题,并认同我们构建安全、普遍有益的AGI的使命,遵循OpenAI章程
- 拥有4年以上AI红队测试、安全研究或相关领域的经验
登录后查看完整岗位详情
使用邮箱验证码登录后,可查看完整职责、任职要求、原岗位入口,并继续使用收藏和浏览记录。列表摘要保持公开,完整详情用于保护数据质量和降低恶意抓取。