返回岗位列表

MiniMax

大模型编排调度工程师(训练&推理方向)

地点:北京 薪资:40-70K 日期:2026-09-18

岗位摘要

负责MiniMax大模型训练与推理平台开发,设计并实现LLM相关工程架构与工具链,保障基建稳定性,支撑大模型业务高速迭代与部署效率;负责超大规模、多云多集群、异构GPU资源的管理、编排与调度,集成多种训推资源管理体系和框架进行统一管理,向全局最优逼近,提升资源流转效率和GPU综合利用率

岗位职责

  • 负责MiniMax大模型训练与推理平台开发,设计并实现LLM相关工程架构与工具链,保障基建稳定性,支撑大模型业务高速迭代与部署效率
  • 负责超大规模、多云多集群、异构GPU资源的管理、编排与调度,集成多种训推资源管理体系和框架进行统一管理,向全局最优逼近,提升资源流转效率和GPU综合利用率
  • 深入业务场景,对LLM训练与推理服务完成编排抽象,持续迭代并落地高效部署模式
  • 负责服务及集群弹性伸缩能力建设,与流量调度、任务调度层深度协作,在保障大模型训推服务质量SLA前提下,完成复杂场景下高效资源流转与在离线混部

任职要求

  • 计算机及相关专业本科及以上学历,具备扎实的计算机体系结构、数据结构与算法、分布式系统基础
  • 熟练掌握Golang、Python、C++中至少一种,具备优秀工程素养和代码品味,深入理解服务化、异步、高可用、可扩展等常规架构设计思想
  • 熟悉Kubernetes及云原生技术栈,深入理解kube-scheduler、Volcano、Koordinator等至少一种调度解决方案
  • 熟悉大语言模型生态,对MoE、PD分离、EP并行等大模型前沿架构有实际工程经验者优先
  • 具有大规模异构集群维护、多云多集群架构、大规模弹性系统、大规模训练任务和推理服务编排、在离线混部及资源调度经验者优先
  • 具备良好的团队沟通合作能力、责任心、自驱力和快速学习能力;有ACM/ICPC、OI等算法竞赛获奖经历者优先
  • 对AI充满热情,善于使用AI Coding工具,有通过AI Agent提升工程链路和架构迭代效率经验者优先

工作地址

北京海淀区蓟门壹号8楼