大模型算法工程Co-Design专家
岗位摘要
深入理解大模型算法架构及训练/推理技术,评估工程可行性、性能瓶颈与成本;主导设计下一代训练/推理框架或核心组件,确保原生支持高效算法实现;系统性解决训练/推理工作负载的计算、通信、存储等性能瓶颈
登录后保留你的岗位线索
邮箱登录后可继续查看完整职责、任职要求和原岗位入口,并使用收藏与浏览记录沉淀适合自己的机会。
岗位职责
- 深入理解大模型算法架构及训练/推理技术,评估工程可行性、性能瓶颈与成本
- 主导设计下一代训练/推理框架或核心组件,确保原生支持高效算法实现
- 系统性解决训练/推理工作负载的计算、通信、存储等性能瓶颈
- 设计并实现高性能核心模块,如定制Kernel,优化通信与数据流水线
- 设计构建大规模分布式训练系统(DeepSpeed/Megatron-LM/FSDP)
- 设计构建高并发、低延迟的大模型推理服务平台
- 跟踪领域前沿技术,探索验证新硬件、非Transformer架构等新技术
- 跨团队高效沟通协作,推动算法、工程、平台方案落地
任职要求
- 计算机/人工智能等相关领域本科及以上学历,或具备同等杰出实践经验
- 深刻理解Transformer架构及大模型训练/推理等相关核心技术
- 精通PyTorch及其分布式训练(DDP/FSDP),有大规模分布式系统设计开发调优经验
- 扎实的计算机体系结构、操作系统、网络基础
- 丰富的性能调优经验,熟练使用Nsight Systems、Profiler等工具
- 参与DeepSpeed/Megatron-LM/vLLM/SGLang等核心框架开发者优先
- 具备GPU Kernel优化(CUDA/Triton)经验者优先
- 有千亿参数级模型训练/部署经验者优先
- 熟悉云平台大规模AI负载管理者优先
加分项
- 参与 DeepSpeed/Megatron
- LM/vLLM/SGLang 等核心框架开发
- GPU Kernel优化 (CUDA/Triton) 经验
- 熟悉云平台大规模AI负载管理
- 陈女士 刚刚活跃
福利待遇
- 月薪30-60K,16薪
- 工作地点位于北京海淀区蓟门壹号
工作地址
北京海淀区蓟门壹号8楼
登录后查看完整岗位详情
使用邮箱验证码登录后,可查看完整职责、任职要求、原岗位入口,并继续使用收藏和浏览记录。列表摘要保持公开,完整详情用于保护数据质量和降低恶意抓取。