大模型训练推理优化工程师
岗位摘要
负责PyTorch模型适配与性能调优;负责多机多卡分布式大模型训练部署与性能优化;负责vLLM/SGLang等推理引擎部署与性能优化;开发高性能CUDA算子;对社区CUDA仓库进行musify优化
登录后保留你的岗位线索
邮箱登录后可继续查看完整职责、任职要求和原岗位入口,并使用收藏与浏览记录沉淀适合自己的机会。
岗位职责
- 负责PyTorch模型适配与性能调优
- 负责多机多卡分布式大模型训练部署与性能优化
- 负责vLLM/SGLang等推理引擎部署与性能优化
- 开发高性能CUDA算子
- 对社区CUDA仓库进行musify优化
- 调研最新机器学习技术并落地
- 深度参与产品新特性研发与支持
任职要求
- 积极乐观,责任心强,工作细致,具备良好团队协作与沟通能力
- 计算机科学、电子工程或相关专业本科及以上学历
- 熟悉机器学习与深度学习算法及实际部署
- 至少熟悉一种主流机器学习框架(TensorFlow、PyTorch、PaddlePaddle、Megatron-LM、Colossal-AI、DeepSpeed、vLLM等)
- 至少精通一种编程语言:CUDA、C++或Python
- 具备扎实的数据结构与算法基础,逻辑清晰
- 2年以上相关技术支持经验者优先
- 熟悉CUDA编程者优先
- 熟悉Docker、Kubernetes等容器化技术者优先
福利待遇
- 年薪25-50K×16薪,极具竞争力
- 参与前沿大模型性能优化,技术成长空间大
- 位于北京望京国际研发园,交通便利
- 与顶尖DevTech团队共事,扁平管理
工作地址
北京朝阳区望京国际研发园I座
登录后查看完整岗位详情
使用邮箱验证码登录后,可查看完整职责、任职要求、原岗位入口,并继续使用收藏和浏览记录。列表摘要保持公开,完整详情用于保护数据质量和降低恶意抓取。