AI/机器学习工程师
岗位摘要
利用Megatron、DeepSpeed等分布式框架进行大规模分布式训练;在大模型、多模态或强化学习等至少一个场景中开展研究与应用工作;进行GPU性能优化分析和模型精度调优;使用nvprof、nvvp、Nsight、Valgrind等工具进行性能分析与调试
登录后保留你的岗位线索
邮箱登录后可继续查看完整职责、任职要求和原岗位入口,并使用收藏与浏览记录沉淀适合自己的机会。
岗位职责
- 利用Megatron、DeepSpeed等分布式框架进行大规模分布式训练
- 在大模型、多模态或强化学习等至少一个场景中开展研究与应用工作
- 进行GPU性能优化分析和模型精度调优
- 使用nvprof、nvvp、Nsight、Valgrind等工具进行性能分析与调试
- 基于TensorFlow、PyTorch等主流框架进行模型开发与优化
任职要求
- 熟悉Megatron、DeepSpeed等分布式训练框架,并具备实际的大规模分布式训练经验
- 对大模型、多模态、强化学习中的至少一个领域有技术积累和独到见解
- 具备GPU性能优化分析和精度调优经验
- 熟练掌握一种或多种主流框架,如TensorFlow或PyTorch
加分项
- (满足一项即可)
- 对数据/模型并行等分布式方案有一定的见解和经验
- 对一种或以上主流框架(TensorFlow/PyTorch等)有开发者视角的理解,对框架设计或者调优有一定的见解和经验
- 熟悉并喜欢高性能优化,对CUDA/OpenCL/BANG/C/OpenMP等并行计算模型有一定的开发经验
- 熟悉GPGPU/MLU/CPU微架构,对软硬件联合优化有一定的见解和经验
登录后查看完整岗位详情
使用邮箱验证码登录后,可查看完整职责、任职要求、原岗位入口,并继续使用收藏和浏览记录。列表摘要保持公开,完整详情用于保护数据质量和降低恶意抓取。