返回岗位列表

Scale AI

高级智能体后训练机器学习研究工程师

地点:美国 薪资:薪资未公开 日期:2026-01-29

岗位摘要

训练最先进的模型(包括内部开发和社区模型),并部署给企业客户;研究前沿算法,并将其直接整合到我们的训练栈中;设计解决方案,使复杂的多智能体系统能够直接从过程奖励和结果奖励中学习;在生产环境中拥有5年以上的LLM训练经验

岗位职责

  • 训练最先进的模型(包括内部开发和社区模型),并部署给企业客户
  • 研究前沿算法,并将其直接整合到我们的训练栈中
  • 设计解决方案,使复杂的多智能体系统能够直接从过程奖励和结果奖励中学习

任职要求

  • 在生产环境中拥有5年以上的LLM训练经验
  • 具备RLHF/RLVR等后训练方法以及PPO/GRPO等相关算法的经验
  • 过去两年内在NEURIPS、ICLR或ICML等顶级会议上发表过论文
  • 拥有计算机科学或相关领域的博士学位或硕士学位

福利待遇

  • 全面的健康、牙科和视力保险
  • 学习和发展津贴
  • 丰厚的带薪休假
  • 可能符合通勤津贴等额外福利