深度学习编译器性能优化工程师
岗位摘要
优化Torch Compile模式下各类神经网络的性能;进行网络性能瓶颈分析、编译耗时优化、codegen性能优化等工作;紧跟PyTorch社区最新技术进展;将前沿性能优化技术及时迁移到MLU平台,以保持技术竞争力和创新性
登录后保留你的岗位线索
邮箱登录后可继续查看完整职责、任职要求和原岗位入口,并使用收藏与浏览记录沉淀适合自己的机会。
岗位职责
- 优化Torch Compile模式下各类神经网络的性能
- 进行网络性能瓶颈分析、编译耗时优化、codegen性能优化等工作
- 紧跟PyTorch社区最新技术进展
- 将前沿性能优化技术及时迁移到MLU平台,以保持技术竞争力和创新性
任职要求
- 具备较强的C++和Python编程能力
- 拥有扎实的数据结构和算法基础
- 学习能力强,有强烈的求知欲和自我驱动能力
- 具备良好的沟通能力和团队协作能力
- 加分项:熟悉PyTorch/TensorFlow等主流深度学习框架及其内部模块与机制
加分项
- 1:熟悉PyTorch/TensorFlow等主流深度学习框架,熟悉框架内部的模块、机制
- 2:熟悉torch inductor、Triton、XLA、MLIR、TVM等深度学习编译技术
登录后查看完整岗位详情
使用邮箱验证码登录后,可查看完整职责、任职要求、原岗位入口,并继续使用收藏和浏览记录。列表摘要保持公开,完整详情用于保护数据质量和降低恶意抓取。