研究员,安全监督
岗位摘要
开发和优化AI监控模型,以检测和缓解已知及新兴的滥用和错位模式;制定研究方向与策略,使我们的AI系统更安全、更对齐、更稳健;评估并设计有效的红队测试流程,检查安全系统的端到端稳健性,并确定未来改进方向
登录后保留你的岗位线索
邮箱登录后可继续查看完整职责、任职要求和原岗位入口,并使用收藏与浏览记录沉淀适合自己的机会。
岗位职责
- 开发和优化AI监控模型,以检测和缓解已知及新兴的滥用和错位模式
- 制定研究方向与策略,使我们的AI系统更安全、更对齐、更稳健
- 评估并设计有效的红队测试流程,检查安全系统的端到端稳健性,并确定未来改进方向
- 开展研究以提升模型对人类价值观问题的推理能力,并将这些改进模型应用于实际安全挑战
- 与跨职能团队(包括T&S、法律、政策及其他研究团队)协调合作,确保产品符合最高安全标准
任职要求
- 对OpenAI构建安全、普遍有益的AGI使命充满热情,并认同OpenAI章程
- 热衷于AI安全,致力于提升尖端AI模型在现实应用中的安全性
- 拥有4年以上AI安全领域经验,尤其是RLHF、人机协作、公平性与偏见等领域
- 持有计算机科学、机器学习或相关领域的博士或其他学位
- 适应涉及大规模AI系统的环境
- 具备4年以上研究工程经验,精通Python或类似语言
登录后查看完整岗位详情
使用邮箱验证码登录后,可查看完整职责、任职要求、原岗位入口,并继续使用收藏和浏览记录。列表摘要保持公开,完整详情用于保护数据质量和降低恶意抓取。