研究工程师(强化学习与多模态)
岗位摘要
多模态强化学习研究:设计并实现新颖的强化学习算法,以支持在多模态(文本+视觉)环境中进行多轮推理和学习;环境规模化:为自动评估和自动用户的'生态系统'做出贡献,构建必要的基础设施,以规模化生成高质量、半可验证的训练环境
登录后保留你的岗位线索
邮箱登录后可继续查看完整职责、任职要求和原岗位入口,并使用收藏与浏览记录沉淀适合自己的机会。
岗位职责
- 多模态强化学习研究:设计并实现新颖的强化学习算法,以支持在多模态(文本+视觉)环境中进行多轮推理和学习
- 环境规模化:为自动评估和自动用户的'生态系统'做出贡献,构建必要的基础设施,以规模化生成高质量、半可验证的训练环境
- 战略应用:应用最先进的方法解决战略问题,特别是缩小单轮与多轮嵌入(检索增强推理)之间的差距
- 实验与分析:跟踪、解释和分析复杂的实验,为我们的训练流程提供科学严谨性
- 协作:充当团队(谷歌研究、核心团队、GDM GenAI)之间的连接者,帮助构建服务于搜索、Lens和YouTube产品需求的对话式基础设施共享管道
任职要求
- 研究工程师背景,对强化学习和多模态充满热情
- 具备在多模态(文本+视觉)环境中设计和实现强化学习算法的能力
- 能够为自动评估和自动用户生态系统的基础设施建设做出贡献
- 具备应用先进方法解决战略问题(如检索增强推理)的经验
- 具备跟踪、解释和分析复杂实验的能力
- 具备跨团队协作能力,能够连接不同团队并构建共享基础设施
福利待遇
- 科学贡献:有机会在强化学习、多模态和推理的高影响力交叉领域发表论文并为科学界做出贡献
- 规模与资源:获得世界级的计算资源和现有的自动评估/自动用户基础设施,使您能够专注于创新而非从零开始构建
登录后查看完整岗位详情
使用邮箱验证码登录后,可查看完整职责、任职要求、原岗位入口,并继续使用收藏和浏览记录。列表摘要保持公开,完整详情用于保护数据质量和降低恶意抓取。