搜广推架构工程师
岗位摘要
参与推荐引擎、深度学习框架、分布式训练、深度学习算法等技术调研、设计及原型开发;探索业界领先技术如千卡、万卡集群上大模型(LLM、文生图、文生视频等)的分布式训练和推理,在壁仞GPGPU上进行原型开发验证
登录后保留你的岗位线索
邮箱登录后可继续查看完整职责、任职要求和原岗位入口,并使用收藏与浏览记录沉淀适合自己的机会。
岗位职责
- 参与推荐引擎、深度学习框架、分布式训练、深度学习算法等技术调研、设计及原型开发
- 探索业界领先技术如千卡、万卡集群上大模型(LLM、文生图、文生视频等)的分布式训练和推理,在壁仞GPGPU上进行原型开发验证
- 针对搜索/广告/推荐等场景,研究大规模稀疏模型训练框架和预估引擎
- 研究大模型驱动的新型搜广推算法和AI工程架构,并在壁仞GPGPU上进行原型开发验证
任职要求
- 计算机、电子、数学及相关专业本科及以上学历
- 熟练使用C++/Python编程
- 熟悉CUDA等异构编程、GPGPU架构优先
- 具备PyTorch/TF/PaddlePaddle/Megatron-LM/DeepSpeed/vLLM/SGlang等框架研发和优化经验优先
- 熟悉Wide&Deep/DLRM/DIEN/MMOE等传统广告/推荐场景算法优先
- 熟悉TIGER/GR/OneRec等大模型驱动的新型算法优先
- 熟悉AIBox/HugeCTR/TorchRec/DeepRec等大规模稀疏模型训练框架优先
- 熟悉稀疏模型预估引擎架构设计和业务落地优先
福利待遇
- 具有竞争力的薪酬:50-80K·15薪
- 参与业界领先的大规模GPU集群技术研发
- 探索前沿大模型分布式训练与推理技术
- 公司位于上海闵行区临港浦江科技广场
工作地址
上海闵行区临港浦江科技广场16号楼
登录后查看完整岗位详情
使用邮箱验证码登录后,可查看完整职责、任职要求、原岗位入口,并继续使用收藏和浏览记录。列表摘要保持公开,完整详情用于保护数据质量和降低恶意抓取。