深度学习框架研发实习生
岗位摘要
参与主流机器学习框架(如PyTorch和PaddlePaddle)与摩尔线程软硬件栈的对接,完成模型训练、推理和部署工作;参与机器学习单GPU以及分布式训练技术的研究与实现,设计开发各种并行与异构计算技术并进行性能优化
登录后保留你的岗位线索
邮箱登录后可继续查看完整职责、任职要求和原岗位入口,并使用收藏与浏览记录沉淀适合自己的机会。
岗位职责
- 参与主流机器学习框架(如PyTorch和PaddlePaddle)与摩尔线程软硬件栈的对接,完成模型训练、推理和部署工作
- 参与机器学习单GPU以及分布式训练技术的研究与实现,设计开发各种并行与异构计算技术并进行性能优化
- 参与研究并实现适合摩尔线程自研GPU的模型优化和压缩方法
- 与硬件团队深度协作,持续提升GPU整体训练效率
任职要求
- 熟悉Linux开发环境,精通C++和Python,具备扎实的算法基础、良好的编程风格和系统设计能力
- 深入理解典型的深度学习算法(如CV和NLP模型),具有主流深度框架(TensorFlow、PyTorch、MxNet、Caffe、PaddlePaddle等)开发或优化经验
- 有深度学习编译器(如XLA、TVM、MLIR)等软件栈的开发经验
- 精通分布式训练技术,有参数服务器、多维并行、显存交换等技术的深入研究与开发者可优先考虑
- 有机器学习模型性能调优和模型压缩(量化、剪枝、蒸馏、NAS等)经验者可优先考虑
- 精通并行计算通信库(如MPI),有丰富的CUDA并行编程和典型机器学习算子开发经验者可优先考虑
- 有强烈的工作责任心,较好的学习能力、沟通能力和自驱力
福利待遇
- 日薪200-300元,硕士在读优先
- 参与前沿GPU硬件与软件栈的深度研发,接触业界领先技术
- 与顶尖工程师团队并肩作战,快速积累实战经验
- 4天/周弹性办公,3个月实习周期灵活
- 工作地点位于北京朝阳区望京国际研发园,交通便利
工作地址
北京朝阳区望京国际研发园l座3层
登录后查看完整岗位详情
使用邮箱验证码登录后,可查看完整职责、任职要求、原岗位入口,并继续使用收藏和浏览记录。列表摘要保持公开,完整详情用于保护数据质量和降低恶意抓取。