高级AI安全研究员
岗位摘要
开发和优化AI监控模型,以检测和减轻已知及新出现的滥用与错位模式;设定研究方向与策略,使我们的AI系统更安全、更对齐、更稳健;评估和设计有效的红队测试流程,以检查我们安全系统的端到端稳健性,并确定未来改进领域
登录后保留你的岗位线索
邮箱登录后可继续查看完整职责、任职要求和原岗位入口,并使用收藏与浏览记录沉淀适合自己的机会。
岗位职责
- 开发和优化AI监控模型,以检测和减轻已知及新出现的滥用与错位模式
- 设定研究方向与策略,使我们的AI系统更安全、更对齐、更稳健
- 评估和设计有效的红队测试流程,以检查我们安全系统的端到端稳健性,并确定未来改进领域
- 进行研究以提高模型对人类价值观相关问题的推理能力,并将这些改进的模型应用于实际的安全挑战
- 与跨职能团队(包括信任与安全、法律、政策和其他研究团队)协调合作,确保我们的产品符合最高安全标准
任职要求
- 对OpenAI构建安全、普遍有益的通用人工智能的使命感到兴奋,并认同OpenAI的章程
- 对AI安全充满热情,并致力于增强前沿AI模型在现实世界中应用的安全性
- 在AI安全领域拥有4年以上经验,特别是在RLHF、人机协作、公平性与偏见等领域
- 拥有计算机科学、机器学习或相关领域的博士学位或其他学位
- 能在涉及大规模AI系统的环境中茁壮成长
- 拥有4年以上的研究工程经验,并精通Python或类似语言
登录后查看完整岗位详情
使用邮箱验证码登录后,可查看完整职责、任职要求、原岗位入口,并继续使用收藏和浏览记录。列表摘要保持公开,完整详情用于保护数据质量和降低恶意抓取。