返回岗位列表

Google DeepMind

研究工程师(强化学习与多模态)

地点:瑞士 薪资:薪资未公开 日期:2026-01-22

岗位摘要

多模态强化学习研究:设计并实现新颖的强化学习算法,以支持在多模态(文本+视觉)环境中进行多轮推理和学习;环境规模化:为自动评估和自动用户的'生态系统'做出贡献,构建必要的基础设施,以规模化生成高质量、半可验证的训练环境

岗位职责

  • 多模态强化学习研究:设计并实现新颖的强化学习算法,以支持在多模态(文本+视觉)环境中进行多轮推理和学习
  • 环境规模化:为自动评估和自动用户的'生态系统'做出贡献,构建必要的基础设施,以规模化生成高质量、半可验证的训练环境
  • 战略应用:应用最先进的方法解决战略问题,特别是缩小单轮与多轮嵌入(检索增强推理)之间的差距
  • 实验与分析:跟踪、解释和分析复杂的实验,为我们的训练流程提供科学严谨性
  • 协作:充当团队(谷歌研究、核心团队、GDM GenAI)之间的连接者,帮助构建服务于搜索、Lens和YouTube产品需求的对话式基础设施共享管道

任职要求

  • 研究工程师背景,对强化学习和多模态充满热情
  • 具备在多模态(文本+视觉)环境中设计和实现强化学习算法的能力
  • 能够为自动评估和自动用户生态系统的基础设施建设做出贡献
  • 具备应用先进方法解决战略问题(如检索增强推理)的经验
  • 具备跟踪、解释和分析复杂实验的能力
  • 具备跨团队协作能力,能够连接不同团队并构建共享基础设施

福利待遇

  • 科学贡献:有机会在强化学习、多模态和推理的高影响力交叉领域发表论文并为科学界做出贡献
  • 规模与资源:获得世界级的计算资源和现有的自动评估/自动用户基础设施,使您能够专注于创新而非从零开始构建