机器学习平台开发工程师
岗位摘要
负责PyTorch模型适配与性能调优;负责多机多卡分布式大模型训练部署与性能调优;负责vLLM及推理引擎部署与性能调优;开发高性能算子;对社区CUDA仓库进行musify;调研最新机器学习技术
登录后保留你的岗位线索
邮箱登录后可继续查看完整职责、任职要求和原岗位入口,并使用收藏与浏览记录沉淀适合自己的机会。
岗位职责
- 负责PyTorch模型适配与性能调优
- 负责多机多卡分布式大模型训练部署与性能调优
- 负责vLLM及推理引擎部署与性能调优
- 开发高性能算子
- 对社区CUDA仓库进行musify
- 调研最新机器学习技术
- 深度参与产品特性开发,为产品支持新特性
任职要求
- 积极乐观,责任心强,工作认真细致,具有良好的团队沟通与协作能力
- 计算机科学、电子工程或相关领域本科及以上学历
- 熟悉机器学习与深度学习算法及实际部署
- 至少熟悉一种机器学习框架的使用或开发,如TensorFlow、PyTorch、PaddlePaddle、Megatron-LM、Colossal-ai、DeepSpeed、vLLM或推理引擎
- 熟悉至少一种编程语言:CUDA、C++、Python
- 具备良好的逻辑思维能力,精通计算机数据结构与算法
- 有2年及以上技术支持或相关领域经验者优先
- 熟悉CUDA编程者优先
- 熟悉Docker、Kubernetes等容器化技术者优先
福利待遇
- 年薪25-50K×16薪,具备竞争力
- 参与前沿大模型与高性能计算项目
- 技术成长空间大,团队氛围积极
- 位于北京望京国际研发园,交通便利
工作地址
北京朝阳区望京国际研发园I座
登录后查看完整岗位详情
使用邮箱验证码登录后,可查看完整职责、任职要求、原岗位入口,并继续使用收藏和浏览记录。列表摘要保持公开,完整详情用于保护数据质量和降低恶意抓取。