深度学习框架研发工程师
岗位摘要
参与PyTorch、PaddlePaddle等主流框架与摩尔线程软硬件栈的适配与性能优化;负责单卡及分布式训练技术的研究、实现与性能调优,包括并行与异构计算;研究并落地面向自研GPU的模型压缩与加速方案,如量化、剪枝、蒸馏
登录后保留你的岗位线索
邮箱登录后可继续查看完整职责、任职要求和原岗位入口,并使用收藏与浏览记录沉淀适合自己的机会。
岗位职责
- 参与PyTorch、PaddlePaddle等主流框架与摩尔线程软硬件栈的适配与性能优化
- 负责单卡及分布式训练技术的研究、实现与性能调优,包括并行与异构计算
- 研究并落地面向自研GPU的模型压缩与加速方案,如量化、剪枝、蒸馏
- 持续优化训练与推理流程,提升系统稳定性与扩展性
任职要求
- 精通Linux、C++与Python,算法扎实,编程规范,具备系统架构能力
- 深入理解CV/NLP模型及TensorFlow、PyTorch等框架源码,有二次开发经验
- 熟悉XLA、TVM、MLIR等深度学习编译器,具备相关开发经历
- 掌握参数服务器、多维并行、显存交换等分布式训练技术
- 具备CUDA并行编程及MPI通信库经验,能独立开发高性能算子
- 责任心强,学习沟通能力强,自驱力高
福利待遇
- 年薪40-60K,极具竞争力的薪酬体系
- 参与国产GPU核心软件栈建设,技术挑战大成长快
- 深圳南山核心科技园区办公,配套完善交通便利
- 与顶尖芯片与AI团队共事,扁平管理开放氛围
工作地址
深圳南山区科兴科学园深圳-南山区科兴科学园B2栋1405室
登录后查看完整岗位详情
使用邮箱验证码登录后,可查看完整职责、任职要求、原岗位入口,并继续使用收藏和浏览记录。列表摘要保持公开,完整详情用于保护数据质量和降低恶意抓取。