AI算子优化工程师
岗位摘要
面向GPU/昇腾架构开展算子性能画像、热点定位与优化,持续提升吞吐与时延稳定性;结合训练与推理场景,协同框架与编译链路进行内核调优、算子融合、内存访问与并行策略优化;建设性能基线与度量方法,沉淀可复用的优化范式与最佳实践,推动持续优化闭环
登录后保留你的岗位线索
邮箱登录后可继续查看完整职责、任职要求和原岗位入口,并使用收藏与浏览记录沉淀适合自己的机会。
岗位职责
- 面向GPU/昇腾架构开展算子性能画像、热点定位与优化,持续提升吞吐与时延稳定性
- 结合训练与推理场景,协同框架与编译链路进行内核调优、算子融合、内存访问与并行策略优化
- 建设性能基线与度量方法,沉淀可复用的优化范式与最佳实践,推动持续优化闭环
任职要求
- 理解计算图、并行化、向量化、内存层次与缓存友好性等关键要点
- 熟悉主流AI算法与框架(如Transformer家族、CV/NLP常用算子;PyTorch/TensorFlow/ONNX等)
- 能独立完成性能分析、问题定位与优化落地,结果导向,热情好学,善于沟通协作与知识沉淀
- 熟悉主流的性能分析工具,熟悉性能优化基本流程和步骤
- 有较强的学习能力,对于AI算法和实现等有比较强的兴趣
- 加分项:在两种及以上平台完成过端到端算子优化,熟悉AI算法的相关实现
加分项
- 在两种及以上平台完成过端到端算子优化 熟悉AI算法的相关实现
- 杜女士 半年前活跃
工作地址
北京海淀区科建大厦4层401
登录后查看完整岗位详情
使用邮箱验证码登录后,可查看完整职责、任职要求、原岗位入口,并继续使用收藏和浏览记录。列表摘要保持公开,完整详情用于保护数据质量和降低恶意抓取。