工程师
岗位摘要
辅助主架构师对GPU芯片及系统的顶层架构进行设计;对接产品经理、客户支持工程师、算法工程师、框架工程师、软件栈工程师,深入理解客户底层需求、并下沉出架构优化方向及具体的设计需求;)计算负载分析及系统顶层架构设计
登录后保留你的岗位线索
邮箱登录后可继续查看完整职责、任职要求和原岗位入口,并使用收藏与浏览记录沉淀适合自己的机会。
岗位职责
- 辅助主架构师对GPU芯片及系统的顶层架构进行设计
- 对接产品经理、客户支持工程师、算法工程师、框架工程师、软件栈工程师,深入理解客户底层需求、并下沉出架构优化方向及具体的设计需求
- )计算负载分析及系统顶层架构设计
- 分析AI/HPC等计算workload,进行GPU计算系统的性能建模与分析
- 站在计算系统的角度(包括计算单元子系统、SoC芯片、多卡、超节点、数据中心、分布式集群)对顶层架构、编程模型、指令集等进行软硬协同设计
- )GPU芯片顶层架构设计
- 辅助主架构师对具体feature展开分析性研究及量化评估、协同design/DV/软件等跨团队推动具体架构特性落地
- 辅助主架构师结合具体工艺,计算芯片算力、带宽等SoC级设计参数的设计平衡,计算面积、功耗、成本等与性能的trade off,制定各模块合理的V/F sign off 目标
任职要求
- 年以上工作经验,或,博士
- )偏算法、多GPU系统
- 具备计算机系统结构知识,理解GPU架构及多GPU系统架构
- 理解AI或HPC算法及其在GPU、系统上的部署和运行flow
- 理解以Transformer模型为基础的LLM、以deepseek为代表的现代MoE模型的架构,及其在训练、推理集群上的运行原理
- 了解大模型向GPU系统部署的并行策略,如数据并行、流水线并行、张量并行、专家并行、上下文并行等
加分项
- Megatron、Zero、VERL、vLLM、SGLang等方面的知识或经验
- 能针对大量性能数据进行综合分析、识别计算瓶颈、提出架构建议
- 能够分析AI模型源代码,并针对目标硬件架构作高层次性能建模
- 具有编程模型、memory model、软硬接口、ISA的知识和经验
- NVSHMEM、NCCL、MPI、PGAS等方面的知识或经验
- PTX、nvcc、CUDA C++、CUTLASS、cuTile、Triton、cuBLUS、cuDNN、TensorRT、PyTorch等方面的知识或经验
- 方向2)偏硬件、SoC
- 具备计算机体系结构知识,理解GPU及SoC架构、理解其编程模型、memory model
- 理解AI或HPC算法在GPU上的运行flow
- 理解算例带宽比的配平原理、roofline model等
- 能分析GPU kernel、有算子设计或分析经验,能进行性能问题分析
- 理解芯片PPA trad-off
- RTL/DV经验、芯片流片经验
- GPU RAS、GPU集群系统稳定性方面的知识或经验
- PCIe、NVLink、IB/ethernet、GPU scale-up/scale-out网路、GPU服务器、GPU集群系统等方面的知识或经验
登录后查看完整岗位详情
使用邮箱验证码登录后,可查看完整职责、任职要求、原岗位入口,并继续使用收藏和浏览记录。列表摘要保持公开,完整详情用于保护数据质量和降低恶意抓取。