大模型推训优化工程师
岗位摘要
负责PyTorch/Paddle等大模型适配与性能调优;完成多机多卡分布式训练部署及性能优化;负责vLLM/SGLang等推理引擎部署与性能调优;开发并优化高性能CUDA算子;对社区CUDA仓库进行musify移植与适配
登录后保留你的岗位线索
邮箱登录后可继续查看完整职责、任职要求和原岗位入口,并使用收藏与浏览记录沉淀适合自己的机会。
岗位职责
- 负责PyTorch/Paddle等大模型适配与性能调优
- 完成多机多卡分布式训练部署及性能优化
- 负责vLLM/SGLang等推理引擎部署与性能调优
- 开发并优化高性能CUDA算子
- 对社区CUDA仓库进行musify移植与适配
- 调研最新机器学习技术并落地到产品
- 深度参与新特性研发,持续提升产品竞争力
任职要求
- 计算机、电子工程等相关专业本科及以上学历
- 熟悉机器学习/深度学习算法及实际部署
- 至少熟悉TensorFlow、PyTorch、Paddle、DeepSpeed、vLLM等一种框架
- 精通CUDA、C++、Python或Triton至少一种语言
- 具备扎实的数据结构、算法与逻辑思维能力
- 积极乐观,责任心强,具备优秀团队协作与沟通能力
福利待遇
- 年薪40-70K×16薪,极具竞争力
- 深度参与前沿大模型与GPU性能优化项目
- 与顶尖技术团队共同探索技术无限可能
- 望京国际研发园优质办公环境
工作地址
北京朝阳区望京国际研发园l座3层
登录后查看完整岗位详情
使用邮箱验证码登录后,可查看完整职责、任职要求、原岗位入口,并继续使用收藏和浏览记录。列表摘要保持公开,完整详情用于保护数据质量和降低恶意抓取。