深度学习框架研发工程师
岗位摘要
负责大规模预训练框架的研发、优化和维护,根据业务需求持续改进训练框架和策略,提升模型训练效率;分析和定位训练中的性能瓶颈,实施针对性优化措施,提升训练效率和稳定性;跟进业界技术进展,不断同步与集成最新训练优化策略
登录后保留你的岗位线索
邮箱登录后可继续查看完整职责、任职要求和原岗位入口,并使用收藏与浏览记录沉淀适合自己的机会。
岗位职责
- 负责大规模预训练框架的研发、优化和维护,根据业务需求持续改进训练框架和策略,提升模型训练效率
- 分析和定位训练中的性能瓶颈,实施针对性优化措施,提升训练效率和稳定性
- 跟进业界技术进展,不断同步与集成最新训练优化策略
任职要求
- 对自然语言处理、计算机视觉和多模态算法有深入理解,熟悉主流LLM和VLM模型架构,有分布式训练经验
- 精通Python编程语言,熟悉PyTorch深度学习框架和Megatron分布式训练框架
- 有大模型预训练优化或MoE训练优化经验者优先考虑
- 在ACM、NOI、IOI、超算比赛中有获奖经历者优先
- 具有CUDA算子优化或性能分析能力者优先
加分项
- 在ACM、NOI、IOI、超算比赛中有获奖经历者优先
- 具有 cuda 算子优化/profiling 能力者优先
- 张先生 刚刚活跃
福利待遇
- 具有竞争力的薪酬:40-70K·16薪
- 硕士及以上学历符合岗位要求,职业发展通道清晰
- 参与前沿大模型训练框架研发,接触业界最新技术方向
工作地址
北京海淀区搜狐网络大厦11层
登录后查看完整岗位详情
使用邮箱验证码登录后,可查看完整职责、任职要求、原岗位入口,并继续使用收藏和浏览记录。列表摘要保持公开,完整详情用于保护数据质量和降低恶意抓取。