返回岗位列表

寒武纪

AI编译器研发工程师

地点:北京 薪资:薪资未公开 日期:2026-01-29

岗位摘要

研究和优化Triton编译器和基于MHLO的图编译器,使其高效支持寒武纪芯片计算架构;基于MLIR + Linalg框架,提升编译器代码执行效率;参与图优化、后端代码生成、调度策略、指令优化、流水并行化等相关优化工作

岗位职责

  • 研究和优化Triton编译器和基于MHLO的图编译器,使其高效支持寒武纪芯片计算架构
  • 基于MLIR + Linalg框架,提升编译器代码执行效率
  • 参与图优化、后端代码生成、调度策略、指令优化、流水并行化等相关优化工作
  • 研究和优化Kernel计算性能,降低计算开销,提高吞吐率
  • 研究算子融合(Op Fusion)、自动调优(Auto-Tuning)、代码生成(CodeGen)相关优化策略
  • 与硬件团队、AI框架团队(如PyTorch/TensorFlow)协作,提升AI编译器的支持能力
  • 跟踪LLVM、Triton、TVM、XLA、TorchInductor等AI编译器前沿技术,优化编译性能

任职要求

  • 优秀的学习能力,对AI编译器、AI计算优化有浓厚兴趣
  • 熟悉C++/Python,具备编译器或AI编译优化开发经验
  • 熟悉Triton、MHLO编译流程
  • 熟悉MLIR、Linalg等基础设施
  • 具备AI编译优化(如TVM、XLA、TorchInductor)经验者优先
  • 熟悉Kernel计算优化、算子融合、自动并行化等高性能计算优化策略者加分
  • 具备MLU/NPU/GPU相关的编译优化经验者优先
  • 有深度加速器上(GPU/NPU)相关算子开发经验者优先
  • 在NeurIPS、ICLR、PLDI、CGO、MICRO等学术会议上发表过AI编译相关论文者优先

加分项

  • 参与过 Triton、MLIR、IREE、XLA、TVM、TorchInductor 等编译器的开发,或在 GitHub 提交过相关 PR
  • 具备MLU/NPU/GPU 相关的编译优化经验
  • 有深度加速器上(gpu/npu)相关算子开发经验
  • 在 NeurIPS、ICLR、PLDI、CGO、MICRO 等学术会议上发表过 AI 编译相关论文