研究员,可信人工智能
岗位摘要
制定研究和策略,以行动相关的方式研究模型的社会影响,并将其反馈到模型设计中;构建创新方法并运行实验,使公众能够参与模型价值观的输入;通过将外部发现转化为稳健的评估,提高外部保证的严谨性
登录后保留你的岗位线索
邮箱登录后可继续查看完整职责、任职要求和原岗位入口,并使用收藏与浏览记录沉淀适合自己的机会。
岗位职责
- 制定研究和策略,以行动相关的方式研究模型的社会影响,并将其反馈到模型设计中
- 构建创新方法并运行实验,使公众能够参与模型价值观的输入
- 通过将外部发现转化为稳健的评估,提高外部保证的严谨性
- 促进并增强我们及时降低旗舰模型部署风险的能力
任职要求
- 对OpenAI构建安全、普遍有益的AGI使命感到兴奋,并与OpenAI章程保持一致
- 展现出对AI安全的热情,致力于使尖端AI模型在现实世界中更安全
- 拥有3年以上研究经验(行业或类似学术经验),并精通Python或类似语言
- 在涉及大规模AI系统和多模态数据集的环境中表现出色
- 喜欢在资源充足的环境中解决大规模、困难且模糊的问题
- 在AI安全领域表现出熟练度,专注于RLHF、对抗训练、鲁棒性、LLM评估等主题
- 对社会技术主题表现出热情
福利待遇
- 提供搬迁援助
登录后查看完整岗位详情
使用邮箱验证码登录后,可查看完整职责、任职要求、原岗位入口,并继续使用收藏和浏览记录。列表摘要保持公开,完整详情用于保护数据质量和降低恶意抓取。