深度学习框架开发工程师
岗位摘要
参与PyTorch、PaddlePaddle等主流机器学习框架与摩尔线程软硬件栈的对接,完成模型训练、推理与部署;研究并实现单GPU及分布式训练技术,包括并行、异构计算方案设计与性能优化
岗位职责
- 参与PyTorch、PaddlePaddle等主流机器学习框架与摩尔线程软硬件栈的对接,完成模型训练、推理与部署
- 研究并实现单GPU及分布式训练技术,包括并行、异构计算方案设计与性能优化
- 针对自研GPU研究并实现模型优化与压缩方法,提升运行效率
任职要求
- 熟悉Linux,精通C++与Python,算法基础扎实,具备良好的编程风格与系统设计能力
- 深入理解CV/NLP等典型深度学习算法,具备TensorFlow、PyTorch等主流框架开发或优化经验
- 有XLA、TVM、MLIR等深度学习编译器开发经验
- 熟悉分布式训练,深入掌握参数服务器、多维并行、显存交换等技术者优先
- 具备模型性能调优与压缩(量化、剪枝、蒸馏、NAS)经验者优先
- 精通MPI等并行计算通信库,有丰富的CUDA并行编程及机器学习算子开发经验者优先
- 责任心强,学习、沟通与自驱能力优秀
- 欢迎校招同学申请
福利待遇
- 30-60K·16薪,极具竞争力的薪酬包
- 可base北京或杭州,灵活选择工作城市
- 加入国产GPU独角兽,参与核心AI生态建设
- 前沿技术课题,快速个人成长与广阔晋升空间
工作地址
北京朝阳区望京国际研发园l座3层