返回岗位列表

寒武纪

AI/机器学习工程师

地点:北京 薪资:薪资未公开 日期:2026-01-29

岗位摘要

利用Megatron、DeepSpeed等分布式框架进行大规模分布式训练;在大模型、多模态或强化学习等至少一个场景中开展研究与应用工作;进行GPU性能优化分析和模型精度调优;使用nvprof、nvvp、Nsight、Valgrind等工具进行性能分析与调试

岗位职责

  • 利用Megatron、DeepSpeed等分布式框架进行大规模分布式训练
  • 在大模型、多模态或强化学习等至少一个场景中开展研究与应用工作
  • 进行GPU性能优化分析和模型精度调优
  • 使用nvprof、nvvp、Nsight、Valgrind等工具进行性能分析与调试
  • 基于TensorFlow、PyTorch等主流框架进行模型开发与优化

任职要求

  • 熟悉Megatron、DeepSpeed等分布式训练框架,并具备实际的大规模分布式训练经验
  • 对大模型、多模态、强化学习中的至少一个领域有技术积累和独到见解
  • 具备GPU性能优化分析和精度调优经验
  • 熟练掌握一种或多种主流框架,如TensorFlow或PyTorch

加分项

  • (满足一项即可)
  • 对数据/模型并行等分布式方案有一定的见解和经验
  • 对一种或以上主流框架(TensorFlow/PyTorch等)有开发者视角的理解,对框架设计或者调优有一定的见解和经验
  • 熟悉并喜欢高性能优化,对CUDA/OpenCL/BANG/C/OpenMP等并行计算模型有一定的开发经验
  • 熟悉GPGPU/MLU/CPU微架构,对软硬件联合优化有一定的见解和经验