返回岗位列表

Scale AI

研究科学家/研究工程师(LLM后训练)

地点:美国 薪资:薪资未公开 日期:2026-01-29

岗位摘要

研究与开发新颖的后训练技术,包括SFT、RLHF和奖励建模,以增强LLM在文本和多模态领域的核心能力;设计与实验新的偏好优化方法;分析模型行为,识别弱点,并提出减轻偏见和增强模型鲁棒性的解决方案

岗位职责

  • 研究与开发新颖的后训练技术,包括SFT、RLHF和奖励建模,以增强LLM在文本和多模态领域的核心能力
  • 设计与实验新的偏好优化方法
  • 分析模型行为,识别弱点,并提出减轻偏见和增强模型鲁棒性的解决方案
  • 在顶级AI会议上发表研究成果
  • 与研究人员和工程师合作,定义数据驱动AI开发的最佳实践
  • 与顶级基础模型实验室合作,为下一代生成式AI模型的开发提供技术和战略建议

任职要求

  • 拥有计算机科学、机器学习、人工智能或相关领域的博士学位或硕士学位
  • 深刻理解深度学习、强化学习和大规模模型微调
  • 具备RLHF、偏好建模或指令调优等后训练技术的经验
  • 在主要会议(如NeurIPS、ICML、ICLR、ACL、EMNLP、CVPR等)和/或期刊上发表过机器学习领域的研究成果

福利待遇

  • 全面的健康、牙科和视力保险
  • 学习与发展津贴
  • 丰厚的带薪休假
  • 可能获得额外的通勤津贴