AI编译器研发工程师
岗位摘要
研究和优化Triton编译器和基于MHLO的图编译器,使其高效支持寒武纪芯片计算架构;基于MLIR + Linalg框架,提升编译器代码执行效率;参与图优化、后端代码生成、调度策略、指令优化、流水并行化等相关优化工作
登录后保留你的岗位线索
邮箱登录后可继续查看完整职责、任职要求和原岗位入口,并使用收藏与浏览记录沉淀适合自己的机会。
岗位职责
- 研究和优化Triton编译器和基于MHLO的图编译器,使其高效支持寒武纪芯片计算架构
- 基于MLIR + Linalg框架,提升编译器代码执行效率
- 参与图优化、后端代码生成、调度策略、指令优化、流水并行化等相关优化工作
- 研究和优化Kernel计算性能,降低计算开销,提高吞吐率
- 研究算子融合(Op Fusion)、自动调优(Auto-Tuning)、代码生成(CodeGen)相关优化策略
- 与硬件团队、AI框架团队(如PyTorch/TensorFlow)协作,提升AI编译器的支持能力
- 跟踪LLVM、Triton、TVM、XLA、TorchInductor等AI编译器前沿技术,优化编译性能
任职要求
- 优秀的学习能力,对AI编译器、AI计算优化有浓厚兴趣
- 熟悉C++/Python,具备编译器或AI编译优化开发经验
- 熟悉Triton、MHLO编译流程
- 熟悉MLIR、Linalg等基础设施
- 具备AI编译优化(如TVM、XLA、TorchInductor)经验者优先
- 熟悉Kernel计算优化、算子融合、自动并行化等高性能计算优化策略者加分
- 具备MLU/NPU/GPU相关的编译优化经验者优先
- 有深度加速器上(GPU/NPU)相关算子开发经验者优先
- 在NeurIPS、ICLR、PLDI、CGO、MICRO等学术会议上发表过AI编译相关论文者优先
加分项
- 参与过 Triton、MLIR、IREE、XLA、TVM、TorchInductor 等编译器的开发,或在 GitHub 提交过相关 PR
- 具备MLU/NPU/GPU 相关的编译优化经验
- 有深度加速器上(gpu/npu)相关算子开发经验
- 在 NeurIPS、ICLR、PLDI、CGO、MICRO 等学术会议上发表过 AI 编译相关论文
登录后查看完整岗位详情
使用邮箱验证码登录后,可查看完整职责、任职要求、原岗位入口,并继续使用收藏和浏览记录。列表摘要保持公开,完整详情用于保护数据质量和降低恶意抓取。