大模型推训优化工程师
岗位摘要
负责PyTorch/Paddle模型适配与性能调优;完成多机多卡大模型训练部署与性能优化;实施vLLM/SGLang等推理引擎部署与性能调优;开发并优化高性能GPU算子;对社区CUDA仓库进行musify移植适配
登录后保留你的岗位线索
邮箱登录后可继续查看完整职责、任职要求和原岗位入口,并使用收藏与浏览记录沉淀适合自己的机会。
岗位职责
- 负责PyTorch/Paddle模型适配与性能调优
- 完成多机多卡大模型训练部署与性能优化
- 实施vLLM/SGLang等推理引擎部署与性能调优
- 开发并优化高性能GPU算子
- 对社区CUDA仓库进行musify移植适配
- 调研最新机器学习技术与平台功能
- 深度参与产品新特性研发与支持
任职要求
- 积极乐观,责任心强,工作细致,具备良好团队协作与沟通能力
- 计算机科学、电子工程或相关专业本科及以上学历
- 熟悉机器学习与深度学习算法及实际部署
- 至少熟悉TensorFlow、PyTorch、Paddle、Megatron-LM、DeepSpeed、vLLM等一种框架
- 熟练掌握CUDA、C++、Triton、Python中至少一种编程语言
- 具备扎实的数据结构与算法基础,逻辑思维能力优秀
福利待遇
- 年薪30-60K×16薪,具备竞争力
- 深度参与前沿大模型与GPU性能优化项目
- 与顶尖技术团队共同探索技术无限可能
- 望京国际研发园优质办公环境
工作地址
北京朝阳区望京国际研发园l座3层
登录后查看完整岗位详情
使用邮箱验证码登录后,可查看完整职责、任职要求、原岗位入口,并继续使用收藏和浏览记录。列表摘要保持公开,完整详情用于保护数据质量和降低恶意抓取。