返回岗位列表

阶跃星辰

工程师

地点:北京 薪资:薪资未公开 日期:2026-01-27

岗位摘要

针对GUI Agent场景,设计和优化预训练、SFT(监督微调)、强化学习流程,以扩展模型能力边界;探索下一代多模态训练范式,包括但不限于奖励模型(Reward Model)、多轮/多智能体强化学习算法以及强化学习预训练方法等前沿技术

岗位职责

  • 针对GUI Agent场景,设计和优化预训练、SFT(监督微调)、强化学习流程,以扩展模型能力边界
  • 探索下一代多模态训练范式,包括但不限于奖励模型(Reward Model)、多轮/多智能体强化学习算法以及强化学习预训练方法等前沿技术

任职要求

  • 国内外计算机科学、人工智能、电子工程等相关专业的博士或优秀研究生学历
  • 具备扎实的工程基础,熟悉大模型背景下的分布式编程技术
  • 熟悉至少一种深度学习框架(如PyTorch、TensorFlow、JAX)
  • 具备深度学习基础知识,了解Transformer架构及其在多模态领域的应用
  • 具备良好的沟通能力和团队协作精神,能独立解决复杂技术问题

加分项

  • 有大规模分布式训练系统开发经验,熟悉DeepSpeed/Megatron等并行训练框架
  • 在顶级会议/期刊(NeurIPS、ICML、CVPR、ACL、ICLR等)发表过相关论文