GPU通信库工程师
岗位摘要
负责对自研芯片的软件栈进行性能评估,分析与定位通信性能瓶颈(软件+硬件),并提出性能调优方案;为硬件架构、编译器、调试与优化工具提供反馈或改进建议,影响未来的软硬件产品;在摩尔线程自研GPU集群上设计、实现和优化GPU通信库(例如用于TensorFlow/Pytorch的NCCL)以及HPC编程接…
登录后保留你的岗位线索
邮箱登录后可继续查看完整职责、任职要求和原岗位入口,并使用收藏与浏览记录沉淀适合自己的机会。
岗位职责
- 负责对自研芯片的软件栈进行性能评估,分析与定位通信性能瓶颈(软件+硬件),并提出性能调优方案
- 为硬件架构、编译器、调试与优化工具提供反馈或改进建议,影响未来的软硬件产品
- 在摩尔线程自研GPU集群上设计、实现和优化GPU通信库(例如用于TensorFlow/Pytorch的NCCL)以及HPC编程接口(例如用于MPI/OpenSHMEM的UCX)
- 设计、实现和维护系统软件,以实现GPU之间的交互以及GPU与其他系统组件(Switch)之间的交互
- 协助验证GPU通信领域硬件的新功能、编程模型的扩展等
任职要求
- 硕士毕业及以上(或本科毕业3年及以上),计算机、通信等相关专业
- 扎实的编程能力,熟练使用C++/Python,有复杂系统软件调试经验
- 熟悉机器学习中的常见通信范式,如PS、AllReduce等集合通信算法
- 熟悉计算机网络及编译原理,熟悉Linux编程
- 熟悉GPU/GPGPU硬件架构、熟悉CUDA编程
- 积极乐观,责任心强,工作认真细致,具备良好的服务意识,具有良好的团队沟通与协作能力
- 加分项:有AI芯片软件栈开发经验
- 加分项:了解InfiniBand、RoCE、iWARP等高性能网络
- 加分项:有PyTorch、TensorFlow等深度学习框架的经验
加分项
- 了解 InfiniBand、RoCE、iWARP 等高性能网络
- 有 PyTorch、TensorFlow 等深度学习框架的经验
- 吴先生 刚刚活跃
- 摩尔线程 · 开发总监
工作地址
成都武侯区天府软件园E区E5-12
登录后查看完整岗位详情
使用邮箱验证码登录后,可查看完整职责、任职要求、原岗位入口,并继续使用收藏和浏览记录。列表摘要保持公开,完整详情用于保护数据质量和降低恶意抓取。