大模型推训优化工程师
岗位摘要
负责PyTorch/Paddle模型在GPU上的适配与性能调优;完成多机多卡大模型训练部署及性能优化;负责vLLM/SGLang等推理引擎部署与性能调优;开发并优化高性能CUDA算子;对社区CUDA仓库进行musify移植与优化
登录后保留你的岗位线索
邮箱登录后可继续查看完整职责、任职要求和原岗位入口,并使用收藏与浏览记录沉淀适合自己的机会。
岗位职责
- 负责PyTorch/Paddle模型在GPU上的适配与性能调优
- 完成多机多卡大模型训练部署及性能优化
- 负责vLLM/SGLang等推理引擎部署与性能调优
- 开发并优化高性能CUDA算子
- 对社区CUDA仓库进行musify移植与优化
- 调研最新机器学习技术与平台功能
- 深度参与产品新特性研发与支持
任职要求
- 计算机、电子工程等相关专业本科及以上学历
- 熟悉机器学习/深度学习算法及实际部署
- 至少熟悉TensorFlow、PyTorch、Paddle、Megatron-LM、vLLM等一种框架
- 熟练掌握CUDA、C++、Triton、Python至少一种语言
- 具备扎实的数据结构与算法基础
- 积极乐观,责任心强,具备优秀团队协作与沟通能力
福利待遇
- 年薪40-70K×16薪,极具竞争力
- 杭州滨江核心地段办公环境
- 参与最前沿AI大模型技术挑战
- 与顶尖GPU性能优化专家共事
- 技术成长空间大,探索无限可能
工作地址
杭州滨江区医惠中心A座9楼
登录后查看完整岗位详情
使用邮箱验证码登录后,可查看完整职责、任职要求、原岗位入口,并继续使用收藏和浏览记录。列表摘要保持公开,完整详情用于保护数据质量和降低恶意抓取。