CUDA C++大模型推理开发工程师
岗位摘要
负责AI模型在摩尔线程芯片上的适配与性能优化,协助客户业务落地;与客户技术团队并肩工作,解决使用摩尔技术栈时的复杂技术难题;提供GPU架构、AI算法、软件架构等优化方案,实现极致GPU加速
登录后保留你的岗位线索
邮箱登录后可继续查看完整职责、任职要求和原岗位入口,并使用收藏与浏览记录沉淀适合自己的机会。
岗位职责
- 负责AI模型在摩尔线程芯片上的适配与性能优化,协助客户业务落地
- 与客户技术团队并肩工作,解决使用摩尔技术栈时的复杂技术难题
- 提供GPU架构、AI算法、软件架构等优化方案,实现极致GPU加速
- 跟踪大模型推理、训练、编译器优化及硬件加速前沿技术,持续迭代软硬件产品
任职要求
- 计算机科学相关专业硕士及以上学历,3年以上相关经验,工程能力强
- 精通C++/Python,具备优秀编程能力
- 熟悉Megatron/DeepSpeed/Sglang/Vllm/VLM等深度学习框架,有大模型推理训练开发与深度优化经验
- 熟悉GPU架构及底层硬件原理,具备CUDA并行编程与算子开发经验优先
- 具备出色分析与解决问题能力,热衷挑战高难度技术难题
- 具备客户服务意识、优秀沟通表达能力与团队合作精神,能在快节奏环境中自我驱动
福利待遇
- 年薪30-60K·16薪,极具竞争力的薪酬包
- 参与国产GPU与大模型前沿技术,技术成长空间大
- 望京核心办公环境,配套完善
- 与顶尖客户及内部团队深度合作,快速积累行业影响力
工作地址
北京朝阳区望京国际研发园l座3层
登录后查看完整岗位详情
使用邮箱验证码登录后,可查看完整职责、任职要求、原岗位入口,并继续使用收藏和浏览记录。列表摘要保持公开,完整详情用于保护数据质量和降低恶意抓取。