深度学习框架开发工程师
岗位摘要
参与主流机器学习框架(如PyTorch和PaddlePaddle)与摩尔线程软硬件栈的对接,支持模型训练、推理和部署;参与机器学习单GPU及分布式训练技术的研究与实现,包括并行与异构计算技术的设计、开发与性能优化
登录后保留你的岗位线索
邮箱登录后可继续查看完整职责、任职要求和原岗位入口,并使用收藏与浏览记录沉淀适合自己的机会。
岗位职责
- 参与主流机器学习框架(如PyTorch和PaddlePaddle)与摩尔线程软硬件栈的对接,支持模型训练、推理和部署
- 参与机器学习单GPU及分布式训练技术的研究与实现,包括并行与异构计算技术的设计、开发与性能优化
- 研究并实现适合摩尔线程自研GPU的模型优化和压缩方法
任职要求
- 熟悉Linux开发环境,精通C++和Python,具备良好扎实的算法基础、良好的编程风格和系统设计能力
- 深入理解典型的深度学习算法(如CV和NLP模型),具有主流深度框架(如TensorFlow、PyTorch、MxNet、Caffe、PaddlePaddle等)的开发或优化经验
- 有深度学习编译器(如XLA、TVM、MLIR)等软件栈的开发经验
- 精通分布式训练技术,有参数服务器、多维并行、显存交换等技术的深入研究与开发者可优先考虑
- 有机器学习模型性能调优和模型压缩(量化、剪枝、蒸馏、NAS等)经验者可优先考虑
- 精通并行计算通信库(如MPI),有丰富的CUDA并行编程和典型机器学习算子开发经验者可优先考虑
- 有强烈的工作责任心,较好的学习能力、沟通能力和自驱力
工作地址
上海浦东新区长泰国际商业广场C座
登录后查看完整岗位详情
使用邮箱验证码登录后,可查看完整职责、任职要求、原岗位入口,并继续使用收藏和浏览记录。列表摘要保持公开,完整详情用于保护数据质量和降低恶意抓取。