研究科学家,Gemini 安全团队
岗位摘要
对最先进的大型语言模型进行后训练和指令微调,重点关注文本到文本、图像/视频/音频到文本的多模态能力以及智能体能力;探索数据、推理和算法解决方案,确保Gemini模型安全、最大程度有用且适用于所有人
登录后保留你的岗位线索
邮箱登录后可继续查看完整职责、任职要求和原岗位入口,并使用收藏与浏览记录沉淀适合自己的机会。
岗位职责
- 对最先进的大型语言模型进行后训练和指令微调,重点关注文本到文本、图像/视频/音频到文本的多模态能力以及智能体能力
- 探索数据、推理和算法解决方案,确保Gemini模型安全、最大程度有用且适用于所有人
- 提升Gemini模型的对抗鲁棒性,重点关注高风险滥用场景
- 设计和维护高质量评估协议,评估模型在安全与公平方面的行为差距和提升空间
- 制定并执行实验计划,以解决已知差距或构建全新能力
- 推动创新,加深对大规模监督微调和强化学习微调的理解
任职要求
- 计算机科学或相关领域的博士学位,或具备同等实践经验
- 拥有丰富的大型语言模型后训练经验
- 具备奖励建模和强化学习用于大型语言模型指令微调的经验者优先
- 具备长程强化学习经验者优先
- 在安全、公平和对齐等领域有经验者优先
- 在NeurIPS、ICLR、ICML、RL/DL、EMNLP、AAAI、UAI等顶级会议上有发表记录者优先
- 有将研究从概念转化为产品的经验者优先
- 有协作或领导应用研究项目的经验者优先
- 有JAX使用经验者优先
福利待遇
- 加入世界顶尖的人工智能研究团队,推动前沿技术发展
- 参与具有广泛社会影响力的安全与公平研究项目
- 与跨学科科学家和工程师紧密协作,享受支持性、奉献性和协作性的团队文化
- 获得将研究成果转化为实际产品的机会
- 公司致力于多元化和包容性,提供平等的就业机会
- 为有残疾或额外需求的员工提供合理便利
登录后查看完整岗位详情
使用邮箱验证码登录后,可查看完整职责、任职要求、原岗位入口,并继续使用收藏和浏览记录。列表摘要保持公开,完整详情用于保护数据质量和降低恶意抓取。