返回岗位列表

阶跃星辰

代码大模型算法工程师/研究员

地点:上海 薪资:30-60K 日期:2026-03-05

岗位摘要

负责代码预训练数据的合成、清洗、权重分配、来源扩充等工作,持续提升代码预训练及中程训练阶段的数据质量;探究预训练小领域数据的配比与最终效果之间的关系,开发数据合成链路以解决代码模型中的关键问题

岗位职责

  • 负责代码预训练数据的合成、清洗、权重分配、来源扩充等工作,持续提升代码预训练及中程训练阶段的数据质量
  • 探究预训练小领域数据的配比与最终效果之间的关系,开发数据合成链路以解决代码模型中的关键问题
  • 探究深度推理技术,研究Test-time Compute和模型效果的Scaling laws
  • 参与后训练奖励模型、强化学习算法的优化流程,构建线上代码补全数据到RL过程的数据飞轮
  • 专注于代码强化学习中奖励模型的优化和创新
  • 配合SFT阶段解决判别能力较差的场景,探究合成数据进行代码奖励模型的预训练
  • 组织标注人员进行代码奖励模型的标注,开展Critic的前沿研究
  • 进行强化学习过程中可执行代码与单元测试的质量过滤和扩充

任职要求

  • 本科及以上学历,计算机、物理、数学、神经科学或相关专业
  • 具备扎实的计算机科学功底和编程能力,熟悉常见算法和数据结构,具有良好的编程习惯
  • 熟悉语言模型的基本技术、模型结构,对AI的未来有信仰和工作热情
  • 工作认真细致,计划性强,具有刨根问底的探究精神
  • 对研发工作有很强的实事求是的落地信念,追求最终效果而非盲目追求新颖方法
  • 对工作内容具有较强责任感
  • 有NOI、ACM竞赛经历者优先,有推荐、搜索领域出色的数据驱动工作者优先
  • 熟悉强化学习相关技术和细节,曾深度参与强化学习项目或语言模型项目者优先
  • 具有较强的工程能力,能迅速熟悉公司内外部平台工具使用,具有主动提升效率的意识者优先

加分项

  • 有NOI、ACM竞赛经历者优先
  • 有推荐、搜索领域出色的数据驱动工作者优先
  • 熟悉强化学习相关技术和细节,曾深度参与强化学习项目或语言模型项目
  • 具有较强的工程能力,能迅速熟悉公司内外部平台工具使用,具有主动提升效率的意识
  • 曾先生 3日内活跃
  • 上海阶跃星辰智能科技 · 数据仓库

工作地址

上海徐汇区西岸凤巢AI PLAZA东塔30楼