大模型Alignment算法研究员
岗位摘要
参与大模型对齐Alignment方向的研发,涉及数据循环、SFT及RL训练算法等相关内容;探索Alignment阶段的数据Scaling Up;解决技术难题,为语言大模型和多模态大模型的落地提供技术支持
登录后保留你的岗位线索
邮箱登录后可继续查看完整职责、任职要求和原岗位入口,并使用收藏与浏览记录沉淀适合自己的机会。
岗位职责
- 参与大模型对齐Alignment方向的研发,涉及数据循环、SFT及RL训练算法等相关内容
- 探索Alignment阶段的数据Scaling Up
- 解决技术难题,为语言大模型和多模态大模型的落地提供技术支持
任职要求
- 985/211高校研究生及以上学历或优秀本科生,计算机科学、人工智能、机器学习等相关专业
- 熟悉大模型前沿进展,如ReACT、POT、Evol-Instruct、DPO、PPO等,具有大模型研发经验者优先
- 具备相关研究经历,发表过ICLR、NeurIPS、ICML、CVPR等顶级会议论文者优先
- 具备扎实的编程基础和优秀的工程能力,具有ACM等编程竞赛获奖者优先
- 具备良好的团队协作能力和沟通能力
福利待遇
- 具有竞争力的薪酬体系,50-80K·16薪
- 硕士学历起点,良好的职业发展平台
- 可接触大模型最前沿技术研究与落地实践
工作地址
北京海淀区大恒科技大厦南座9层
登录后查看完整岗位详情
使用邮箱验证码登录后,可查看完整职责、任职要求、原岗位入口,并继续使用收藏和浏览记录。列表摘要保持公开,完整详情用于保护数据质量和降低恶意抓取。