返回岗位列表

摩尔线程

大模型基础设施架构师

地点:北京 薪资:60-90K 日期:2026-03-03

岗位摘要

研究并实现超大规模GPU集群分布式训练技术,提升MOE大模型与强化学习训练吞吐;调研并实现大模型前沿算法;研发并调优大模型训练与推理框架;熟悉Python或C++,算法与计算机基础扎实,编程规范良好

岗位职责

  • 研究并实现超大规模GPU集群分布式训练技术,提升MOE大模型与强化学习训练吞吐
  • 调研并实现大模型前沿算法
  • 研发并调优大模型训练与推理框架

任职要求

  • 熟悉Python或C++,算法与计算机基础扎实,编程规范良好
  • 熟悉深度学习及大模型训练相关算法
  • 熟练使用PyTorch/JAX/Paddle等深度学习框架
  • 责任心强,学习、沟通、自驱能力佳

加分项

  • 有大规模GPU集群性能优化和训练经验优先
  • 熟悉大模型训练框架和推理框架,包括不限于Megatron/DeepSpeed/ColossalAI/torchtitan/sglang/vllm等
  • 熟悉大模型算法,如大模型基础架构/强化学习/多模态/视频生成等
  • 在顶级会议发表论文或有竞赛经验优先考虑
  • 熟悉cuda相关开发
  • 汪伟 刚刚活跃

福利待遇

  • 优先接触千卡级GPU集群性能优化实战
  • 深度掌握Megatron/DeepSpeed/ColossalAI/torchtitan/sglang/vLLM等主流框架
  • 参与大模型基础架构/强化学习/多模态/视频生成等前沿算法研究
  • 顶级会议论文发表及竞赛机会
  • CUDA底层开发技能提升

工作地址

北京朝阳区望京国际研发园l座3层