返回岗位列表

阶跃星辰

强化学习算法工程师/研究员

地点:北京 薪资:40-70K 日期:2026-05-22

岗位摘要

研究语言及多模态大模型RLHF阶段的广义强化算法,提升大模型能力,探索大模型的自我进化之路;研究大模型驱动的智能体算法,包括但不局限于ReACT、Voyager、WebGPT、AutoGPT等方向

岗位职责

  • 研究语言及多模态大模型RLHF阶段的广义强化算法,提升大模型能力,探索大模型的自我进化之路
  • 研究大模型驱动的智能体算法,包括但不局限于ReACT、Voyager、WebGPT、AutoGPT等方向
  • 撰写技术报告和论文,分享研究成果,参与内外部技术交流和合作,推动团队技术水平的提升,提高团队在行业内的影响力

任职要求

  • 985/211高校硕士或博士学位,计算机科学、人工智能、自动化、数学等专业优先
  • 具备扎实的机器学习基础和强悍的编码能力,能熟练使用 PyTorch
  • 3-5年工作经验,在大模型训练和强化学习至少一个方向上有在学术或工业界具有高影响力的工作成果
  • 对人工智能和大模型技术有强烈的兴趣和热情,愿意不断学习和探索新技术

加分项

  • 有 ICML、ICLR、NeurIPS、ACL、CVPR 等顶级学术会议发表过有影响力研究成果的优先
  • 在 ACM/ICPC、NOI/IOI、Kaggle 等编程/AI 比赛获奖者优先
  • 主导、参与过 AI 相关的有大影响力的开源/闭源项目的优先
  • 祝女士 刚刚活跃

福利待遇

  • 薪资范围40-70K·16薪,具有竞争力的薪酬体系
  • 参与前沿大模型技术研究,有机会接触行业顶级学术资源
  • 支持发表顶级学术论文、参加高水平学术会议,提升个人学术影响力
  • 参与具有大影响力的开源/闭源项目,积累宝贵工程经验

工作地址

北京海淀区大恒科技大厦南座12层