返回岗位列表

摩尔线程

大模型Infra/算法工程师

地点:北京 薪资:40-70K 日期:2026-06-26

岗位摘要

研究并实现超大GPU集群分布式训练技术,提高MOE大模型和强化学习的训练吞吐;调研和实现大模型前沿算法;研发并优化大模型训练框架和推理框架,进行性能调优;熟悉Python或C++,具备扎实的算法和计算机基础及良好编程风格

岗位职责

  • 研究并实现超大GPU集群分布式训练技术,提高MOE大模型和强化学习的训练吞吐
  • 调研和实现大模型前沿算法
  • 研发并优化大模型训练框架和推理框架,进行性能调优

任职要求

  • 熟悉Python或C++,具备扎实的算法和计算机基础及良好编程风格
  • 熟悉深度学习和大模型训练相关算法
  • 熟练使用深度学习框架,包括但不限于PyTorch/JAX/Paddle
  • 有强烈的工作责任心,较好的学习能力、沟通能力和自驱力
  • 加分项:有大规模GPU集群性能优化和训练经验
  • 加分项:熟悉大模型训练框架和推理框架,如Megatron/DeepSpeed/ColossalAI/torchtitan/sglang/vllm等
  • 加分项:熟悉大模型算法,如基础架构/强化学习/多模态/视频生成等
  • 加分项:在顶级会议发表论文或有竞赛经验
  • 加分项:熟悉CUDA相关开发

加分项

  • 有大规模GPU集群性能优化和训练经验优先
  • 熟悉大模型训练框架和推理框架, 包括不限于 Megatron/DeepSpeed/ColossalAl/torchtitan/sglang/vlIm等
  • 熟悉大模型算法, 如大模型基础架构/强化学习/多模态/ /视频生成等
  • 在顶级会议发表论文或有竞赛经验优先考虑
  • 熟悉cuda相关开发
  • 刘女士 刚刚活跃

福利待遇

  • 薪资范围:40-70K·16薪
  • 工作地点:北京朝阳区望京国际研发园
  • 经验不限,本科及以上学历

工作地址

北京朝阳区望京国际研发园