大模型平台研发工程师
岗位摘要
负责Minimax推理平台和机器学习平台的开发,支撑公司大模型业务高速迭代;负责超大规模复杂场景下GPU资源编排和调度,提升资源流转效率和GPU资源利用率;设计和实现大模型相关的基础设施、工程架构和工具链,保证基建稳定性和推理服务的部署迭代效率
登录后保留你的岗位线索
邮箱登录后可继续查看完整职责、任职要求和原岗位入口,并使用收藏与浏览记录沉淀适合自己的机会。
岗位职责
- 负责Minimax推理平台和机器学习平台的开发,支撑公司大模型业务高速迭代
- 负责超大规模复杂场景下GPU资源编排和调度,提升资源流转效率和GPU资源利用率
- 设计和实现大模型相关的基础设施、工程架构和工具链,保证基建稳定性和推理服务的部署迭代效率
任职要求
- 扎实的计算机体系结构和分布式系统基础,熟悉Kubernetes及云原生技术栈
- 熟悉kube-scheduler、volcano、koordinator等至少一种调度解决方案,具有大规模训练任务和推理服务的编排经验
- 具备在离线混部及资源调度经验者优先
- 扎实的工程素养,良好的代码习惯,熟练掌握Golang/Python/C++至少一门语言
- 善于使用AI Coding提升工作效率
- 具备良好沟通合作能力,对AI有热情
- 有通过AI Agent提升工程链路和架构迭代效率经验者优先
工作地址
北京海淀区蓟门壹号8楼
登录后查看完整岗位详情
使用邮箱验证码登录后,可查看完整职责、任职要求、原岗位入口,并继续使用收藏和浏览记录。列表摘要保持公开,完整详情用于保护数据质量和降低恶意抓取。