返回岗位列表

Google DeepMind

研究科学家,Gemini 安全团队

地点:美国 薪资:薪资未公开 日期:2026-07-20

岗位摘要

对最先进的大型语言模型进行后训练和指令微调,重点关注文本到文本、图像/视频/音频到文本的多模态能力以及智能体能力;探索数据、推理和算法解决方案,确保Gemini模型安全、最大程度有用且适用于所有人

岗位职责

  • 对最先进的大型语言模型进行后训练和指令微调,重点关注文本到文本、图像/视频/音频到文本的多模态能力以及智能体能力
  • 探索数据、推理和算法解决方案,确保Gemini模型安全、最大程度有用且适用于所有人
  • 提升Gemini模型的对抗鲁棒性,重点关注高风险滥用场景
  • 设计和维护高质量评估协议,评估模型在安全与公平方面的行为差距和提升空间
  • 制定并执行实验计划,以解决已知差距或构建全新能力
  • 推动创新,加深对大规模监督微调和强化学习微调的理解

任职要求

  • 计算机科学或相关领域的博士学位,或具备同等实践经验
  • 拥有丰富的大型语言模型后训练经验
  • 具备奖励建模和强化学习用于大型语言模型指令微调的经验者优先
  • 具备长程强化学习经验者优先
  • 在安全、公平和对齐等领域有经验者优先
  • 在NeurIPS、ICLR、ICML、RL/DL、EMNLP、AAAI、UAI等顶级会议上有发表记录者优先
  • 有将研究从概念转化为产品的经验者优先
  • 有协作或领导应用研究项目的经验者优先
  • 有JAX使用经验者优先

福利待遇

  • 加入世界顶尖的人工智能研究团队,推动前沿技术发展
  • 参与具有广泛社会影响力的安全与公平研究项目
  • 与跨学科科学家和工程师紧密协作,享受支持性、奉献性和协作性的团队文化
  • 获得将研究成果转化为实际产品的机会
  • 公司致力于多元化和包容性,提供平等的就业机会
  • 为有残疾或额外需求的员工提供合理便利