返回岗位列表

壁仞科技

GPU基础软件工程师(校招)

地点:上海 薪资:31-51K 日期:2026-03-03

岗位摘要

参与工业级编译器与工具链研发,包括前端/IR/优化/后端代码生成及自研CUDA兼容运行时;负责自研AI编译器的多层次IR设计、Pass设计及自研DSL开发;开展kernel级性能优化,建立理论性能模型,进行瓶颈定位、波形级调优及通信计算融合

岗位职责

  • 参与工业级编译器与工具链研发,包括前端/IR/优化/后端代码生成及自研CUDA兼容运行时
  • 负责自研AI编译器的多层次IR设计、Pass设计及自研DSL开发
  • 开展kernel级性能优化,建立理论性能模型,进行瓶颈定位、波形级调优及通信计算融合
  • 参与BIRENSUPA编程语言设计,在编程模型、语言抽象及性能易用性之间做出权衡
  • 参与训练与推理框架的研发与适配,在壁仞当代及下一代硬件上进行端到端性能分析与优化
  • 与硬件团队协作,协同设计下一代GPU硬件架构
  • 持续改进工程质量,包括代码评审、单元/集成测试、文档维护及AI辅助编程实践

任职要求

  • 计算机科学/电子工程等相关专业硕士或博士应届毕业生
  • 扎实的计算机科学基础,包括数据结构与算法、操作系统、计算机组成原理、编译原理
  • 熟练掌握C/C++编程,熟悉至少一种脚本语言
  • 熟悉Linux开发环境
  • 熟悉计算机体系架构与并行计算,能够实践并行/并发、内存模型、缓存/向量化等性能相关概念
  • 对底层GPU软件与异构系统有强烈兴趣,具备良好的沟通协作能力
  • 具备良好的英文技术文档及论文阅读能力
  • 具有LLVM/MLIR、TVM、Triton、TorchInductor等编译栈经验者优先
  • 了解CUDA/OpenCL/ROCm,熟悉GPU并行执行模型(SIMT、warp/occupancy、memory coalescing、shared memory等)者优先
  • 有操作系统/GPU kernel/驱动或异构runtime(调度、异步执行、DMA/通信)相关经验者优先
  • 具备系统编程、向量化/汇编(SSE/AVX/NEON)或性能工具链搭建能力者优先
  • 有编译器/解释器/模拟器/GPU kernel等项目经验或高质量开源项目贡献者优先
  • 有ACM/ICPC、NOI等编程竞赛或系统/编译相关研究经历者优先

加分项

  • 具有 LLVM/MLIR、TVM、Triton、TorchInductor 等编译栈经验
  • 了解 CUDA/OpenCL/ROCm,熟悉 GPU 并行执行模型(SIMT、warp/occupancy、memory coalescing、shared memory 等)
  • 有操作系统/GPU kernel/驱动或异构 runtime(调度、异步执行、DMA/通信)相关经验
  • 具备系统编程、向量化/汇编(SSE/AVX/NEON)或性能工具链搭建能力
  • 有编译器/解释器/模拟器/GPU kernel等项目经验,或高质量开源项目贡献
  • ACM/ICPC、NOI 等编程竞赛或系统/编译相关研究经历
  • 我们专注于构建下一代高性能GPU计算平台的核心基础软件,聚焦传统编译、AI编译、kernel优化、编程语言/DSL 设计等方向,面向 GPU 的底层软件栈
  • 我们相信:最好的架构师,从第一行代码开始培养。我们不只培养写代码的工程师,更培养理解系统全貌、能够做出技术决策的架构师
  • 你将深入的技术领域