深度学习框架开发工程师
岗位摘要
参与PyTorch、PaddlePaddle等主流机器学习框架与摩尔线程软硬件栈的适配、训练与推理部署;负责单GPU及分布式训练技术研究与实现,包括并行、异构计算方案设计及性能优化;研究并落地面向摩尔线程自研GPU的模型压缩与加速算法,如量化、剪枝、蒸馏等
登录后保留你的岗位线索
邮箱登录后可继续查看完整职责、任职要求和原岗位入口,并使用收藏与浏览记录沉淀适合自己的机会。
岗位职责
- 参与PyTorch、PaddlePaddle等主流机器学习框架与摩尔线程软硬件栈的适配、训练与推理部署
- 负责单GPU及分布式训练技术研究与实现,包括并行、异构计算方案设计及性能优化
- 研究并落地面向摩尔线程自研GPU的模型压缩与加速算法,如量化、剪枝、蒸馏等
任职要求
- 精通C++、Python,熟悉Linux开发环境,算法基础扎实,编程规范良好
- 深入理解CV/NLP等典型深度学习算法,具备TensorFlow、PyTorch等框架开发或优化经验
- 有XLA、TVM、MLIR等深度学习编译器开发经验
- 熟悉参数服务器、多维并行、显存交换等分布式训练技术
- 具备CUDA并行编程及MPI通信库经验,能开发高性能机器学习算子
- 责任心强,学习沟通能力强,自驱力高
- 校招同学亦可申请
福利待遇
- 年薪30-60K×16薪,极具竞争力
- 杭州/北京/深圳多地点灵活办公
- 参与国产GPU核心生态建设,技术挑战大成长快
工作地址
深圳南山区科兴科学园南山区科苑路15号科兴科学园
登录后查看完整岗位详情
使用邮箱验证码登录后,可查看完整职责、任职要求、原岗位入口,并继续使用收藏和浏览记录。列表摘要保持公开,完整详情用于保护数据质量和降低恶意抓取。