大模型Infra/算法工程师
岗位摘要
超大规模GPU集群分布式训练技术的研究与实现,提高MOE大模型和强化学习的训练吞吐;大模型前沿算法调研和实现;大模型训练框架和推理框架研发与性能调优;熟悉Python或C++,具备扎实的算法和计算机基础、良好的编程风格
登录后保留你的岗位线索
邮箱登录后可继续查看完整职责、任职要求和原岗位入口,并使用收藏与浏览记录沉淀适合自己的机会。
岗位职责
- 超大规模GPU集群分布式训练技术的研究与实现,提高MOE大模型和强化学习的训练吞吐
- 大模型前沿算法调研和实现
- 大模型训练框架和推理框架研发与性能调优
任职要求
- 熟悉Python或C++,具备扎实的算法和计算机基础、良好的编程风格
- 熟悉深度学习和大模型训练相关算法
- 熟练使用深度学习框架,包括不限于PyTorch/JAX/Paddle等
- 有强烈的工作责任心,较好的学习能力、沟通能力和自驱力
- 有大规模GPU集群性能优化和训练经验者优先
- 熟悉大模型训练框架和推理框架,包括不限于Megatron/DeepSpeed/ColossalAI/TorchTitan/sglang/vllm等
- 熟悉大模型算法,如大模型基础架构/强化学习/多模态/视频生成等
- 在顶级会议发表论文或有竞赛经验者优先考虑
- 熟悉CUDA相关开发者优先
加分项
- 有大规模GPU集群性能优化和训练经验优先
- 熟悉大模型训练框架和推理框架,包括不限于Megatron/DeepSpeed/ColossalAI/torchtitan/sglang/vllm等
- 熟悉大模型算法,如大模型基础架构/强化学习/多模态/视频生成等
- 在顶级会议发表论文或有竞赛经验优先考虑
- 熟悉cuda相关开发
- 丰女士 刚刚活跃
- 摩尔线程 · 人事HRBP
福利待遇
- 具有竞争力的薪酬:40-60K·16薪
- base覆盖杭州、北京、上海、深圳等多个城市
- 加入知名AI芯片公司摩尔线程,接触前沿大模型技术
- 参与大规模GPU集群训练基础设施建设
工作地址
杭州萧山区信息港7期5幢16楼
登录后查看完整岗位详情
使用邮箱验证码登录后,可查看完整职责、任职要求、原岗位入口,并继续使用收藏和浏览记录。列表摘要保持公开,完整详情用于保护数据质量和降低恶意抓取。