高性能异构计算工程师
岗位摘要
参与壁仞GPU芯片高性能软件栈的设计与优化;负责高性能算子算法性能设计、评估、分析与优化;参与硬件关键功能、精度与性能研讨与评估;关注前沿技术发展动态,探索新技术方案在壁仞生态上的落地;熟悉C++泛型编程与设计模式,3年以上C++使用经验或2年高性能计算开发经验
登录后保留你的岗位线索
邮箱登录后可继续查看完整职责、任职要求和原岗位入口,并使用收藏与浏览记录沉淀适合自己的机会。
岗位职责
- 参与壁仞GPU芯片高性能软件栈的设计与优化
- 负责高性能算子算法性能设计、评估、分析与优化
- 参与硬件关键功能、精度与性能研讨与评估
- 关注前沿技术发展动态,探索新技术方案在壁仞生态上的落地
任职要求
- 熟悉C++泛型编程与设计模式,3年以上C++使用经验或2年高性能计算开发经验
- 良好的异构编程基础,熟悉NV或AMD架构,掌握CUDA或HIP
- 具备Tensor-core算子MMA/Conv开发、量化稀疏优化经验,尤其CUTLASS/Flash-Attention/FlashMLA项目经验
- 熟悉PyTorch/vLLM/TensorRT-LLM/DeepSeek等DL框架及大模型基础工程
- 硕士学历,3-5年相关经验
加分项
- CUTLASS实际编程经验或社区贡献者
- 卓越的GPU领域相关论文
- AI领域社区贡献者
- 李超鹏 刚刚活跃
- 壁仞科技 · TensorCore计算Leader
福利待遇
- 与顶尖GPU团队共事,参与国产芯生态建设
- 技术深度挑战,前沿论文与社区贡献机会
- 上海核心科技园区办公,配套完善
工作地址
上海闵行区临港浦江科技广场16号楼
登录后查看完整岗位详情
使用邮箱验证码登录后,可查看完整职责、任职要求、原岗位入口,并继续使用收藏和浏览记录。列表摘要保持公开,完整详情用于保护数据质量和降低恶意抓取。