返回岗位列表

摩尔线程

大模型基础设施工程师

地点:北京 薪资:30-50K 日期:2026-03-03

岗位摘要

研究并实现超大规模GPU集群分布式训练技术,提升MOE大模型与强化学习训练吞吐;研发与调优大模型训练框架及推理框架,保障系统高效稳定;调研大模型前沿算法并完成工程化实现,推动技术落地;熟悉Python或C++,算法与计算机基础扎实,编程规范良好

岗位职责

  • 研究并实现超大规模GPU集群分布式训练技术,提升MOE大模型与强化学习训练吞吐
  • 研发与调优大模型训练框架及推理框架,保障系统高效稳定
  • 调研大模型前沿算法并完成工程化实现,推动技术落地

任职要求

  • 熟悉Python或C++,算法与计算机基础扎实,编程规范良好
  • 深入理解深度学习及大模型训练相关算法
  • 熟练使用PyTorch/JAX/Paddle等深度学习框架
  • 具备强烈责任心、优秀学习能力、沟通协作与自驱力
  • 有大规模GPU集群性能优化及训练经验优先
  • 熟悉Megatron/DeepSpeed/ColossalAI/torchtitan/sglang/vLLM等训练推理框架优先
  • 熟悉大模型基础架构、强化学习、多模态、视频生成等算法优先
  • 掌握CUDA、NCCL等GPU开发技术优先
  • 在顶会发表论文或竞赛获奖经历优先

加分项

  • 有大规模GPU集群性能优化和训练经验优先
  • 熟悉大模型训练框架和推理框架,包括不限于Megatron/DeepSpeed/ColossalAI/torchtitan/sglang/vllm等
  • 熟悉大模型算法,如大模型基础架构/强化学习/多模态/视频生成等
  • 熟悉GPU相关开发,如CUDA,NCCL等
  • 在顶级会议发表论文或有竞赛经验优先考虑
  • 张先生 本周活跃

福利待遇

  • 15薪,年薪45-75万元
  • 硕士学历1-3年经验即可投递
  • 北京望京国际研发园优质办公环境
  • 与顶级GPU团队共同成长,技术氛围浓厚

工作地址

北京朝阳区望京国际研发园I座3楼