研究科学家/研究工程师(LLM后训练)
岗位摘要
研究与开发新颖的后训练技术,包括SFT、RLHF和奖励建模,以增强LLM在文本和多模态领域的核心能力;设计与实验新的偏好优化方法;分析模型行为,识别弱点,并提出减轻偏见和增强模型鲁棒性的解决方案
登录后保留你的岗位线索
邮箱登录后可继续查看完整职责、任职要求和原岗位入口,并使用收藏与浏览记录沉淀适合自己的机会。
岗位职责
- 研究与开发新颖的后训练技术,包括SFT、RLHF和奖励建模,以增强LLM在文本和多模态领域的核心能力
- 设计与实验新的偏好优化方法
- 分析模型行为,识别弱点,并提出减轻偏见和增强模型鲁棒性的解决方案
- 在顶级AI会议上发表研究成果
- 与研究人员和工程师合作,定义数据驱动AI开发的最佳实践
- 与顶级基础模型实验室合作,为下一代生成式AI模型的开发提供技术和战略建议
任职要求
- 拥有计算机科学、机器学习、人工智能或相关领域的博士学位或硕士学位
- 深刻理解深度学习、强化学习和大规模模型微调
- 具备RLHF、偏好建模或指令调优等后训练技术的经验
- 在主要会议(如NeurIPS、ICML、ICLR、ACL、EMNLP、CVPR等)和/或期刊上发表过机器学习领域的研究成果
福利待遇
- 全面的健康、牙科和视力保险
- 学习与发展津贴
- 丰厚的带薪休假
- 可能获得额外的通勤津贴
登录后查看完整岗位详情
使用邮箱验证码登录后,可查看完整职责、任职要求、原岗位入口,并继续使用收藏和浏览记录。列表摘要保持公开,完整详情用于保护数据质量和降低恶意抓取。