AI基础设施-模型服务化工程师
岗位摘要
支持MiniMax模型在全球多机房的大规模部署与性能优化;与模型框架团队协作,优化模型推理中的系统开销,构建高性能推理服务;参与端到端模型推理服务的研发,在多流量入口、多云多机房等复杂场景下构建稳定高效的服务架构和部署模式
登录后保留你的岗位线索
邮箱登录后可继续查看完整职责、任职要求和原岗位入口,并使用收藏与浏览记录沉淀适合自己的机会。
岗位职责
- 支持MiniMax模型在全球多机房的大规模部署与性能优化
- 与模型框架团队协作,优化模型推理中的系统开销,构建高性能推理服务
- 参与端到端模型推理服务的研发,在多流量入口、多云多机房等复杂场景下构建稳定高效的服务架构和部署模式
- 最优化模型服务性能,提升整体推理效率
- 构建服务治理能力,参与可观测性、压力测试、容灾、调试、降级、灰度等能力建设
- 输出标准技术文档,以可交付为标准进行持续迭代优化
任职要求
- 计算机及相关专业,本科及以上学历
- 3年以上系统工程或高性能服务工作经验
- 深入理解操作系统基本原理
- 能熟练使用至少一种编程语言,包括但不限于Golang/Python/C++/C
- 理解常规架构设计思想,包括但不限于服务化、异步、高可用、可扩展等
- 具备良好的可靠性意识,包括但不限于监控、容灾等
- 有良好的团队沟通和协作能力,责任心强
- 理解常用推理框架如SGLang、vLLM等优先
福利待遇
- 薪资范围40-70K,16薪制
- 工作地点位于北京海淀区核心区域
工作地址
北京海淀区蓟门壹号8楼
登录后查看完整岗位详情
使用邮箱验证码登录后,可查看完整职责、任职要求、原岗位入口,并继续使用收藏和浏览记录。列表摘要保持公开,完整详情用于保护数据质量和降低恶意抓取。