GLM团队-训练/推理Infra算法工程师(实习)
岗位摘要
与算法团队深度协作,参与下一代GLM大模型架构设计与系统实现,推动模型结构与系统效率的协同优化;构建大模型推理成本分析与模拟系统,从算力、通信、KV cache、并行策略等维度优化推理效率
登录后保留你的岗位线索
邮箱登录后可继续查看完整职责、任职要求和原岗位入口,并使用收藏与浏览记录沉淀适合自己的机会。
岗位职责
- 与算法团队深度协作,参与下一代GLM大模型架构设计与系统实现,推动模型结构与系统效率的协同优化
- 构建大模型推理成本分析与模拟系统,从算力、通信、KV cache、并行策略等维度优化推理效率
- 设计与优化超大规模训练基础设施(万卡级),提升训练稳定性、资源利用率与训练效率
- 探索MoE、Sparse Attention、长上下文等新架构在训练与推理系统中的高效落地
任职要求
- 熟悉主流LLM模型架构,有分布式训练/推理优化经验
- 熟悉Megatron分布式训练框架或sglang、vllm等推理框架
- 熟悉CUDA kernel优化者优先考虑
福利待遇
- 有竞争力的日薪(300-500元/天)
- 参与前沿GLM大模型(百亿到万亿参数级)的系统设计与研发
- 万卡规模训练系统的优化与稳定性工程实践经验
- 专业团队 mentorship,与顶级算法与系统工程团队深度合作
工作地址
北京海淀区智谱华章科技有限公司1
登录后查看完整岗位详情
使用邮箱验证码登录后,可查看完整职责、任职要求、原岗位入口,并继续使用收藏和浏览记录。列表摘要保持公开,完整详情用于保护数据质量和降低恶意抓取。