返回岗位列表

阶跃星辰

大模型对齐方向研究员

地点:北京 薪资:薪资未公开 日期:2026-01-20

岗位摘要

参与通用推理大模型对齐方向的研发工作,涵盖数据循环体系的构建;在监督微调与强化学习阶段,系统性探究数据使用策略;深入探索对齐阶段的数据与算法在大规模训练中的可扩展性与优化路径;参与构建世界领先的高性能通用推理大模型,在多项客观评测指标中保持行业领先

岗位职责

  • 参与通用推理大模型对齐方向的研发工作,涵盖数据循环体系的构建
  • 在监督微调与强化学习阶段,系统性探究数据使用策略
  • 深入探索对齐阶段的数据与算法在大规模训练中的可扩展性与优化路径
  • 参与构建世界领先的高性能通用推理大模型,在多项客观评测指标中保持行业领先

任职要求

  • 国内外计算机、数学、人工智能等相关专业的博士或优秀研究生
  • 对大模型相关研究前沿进展比较熟悉,如Reasoning RL、Agent RL等,具有大模型研发经验者优先
  • 有一定的相关研究经历,发表过顶级会议论文者优先,如ICLR, NeurIPS, ICML等