Kubernetes 调度器开发工程师
岗位摘要
负责Kubernetes调度器及调度插件的深度定制,设计面向AI工作负载的调度策略(GPU拓扑感知、NUMA亲和、网络亲和、RDMA域感知);攻克超大规模集群(万卡级)调度性能瓶颈,优化调度吞吐、调度延迟与决策质量,支持每秒数百Pod的调度并发
登录后保留你的岗位线索
邮箱登录后可继续查看完整职责、任职要求和原岗位入口,并使用收藏与浏览记录沉淀适合自己的机会。
岗位职责
- 负责Kubernetes调度器及调度插件的深度定制,设计面向AI工作负载的调度策略(GPU拓扑感知、NUMA亲和、网络亲和、RDMA域感知)
- 攻克超大规模集群(万卡级)调度性能瓶颈,优化调度吞吐、调度延迟与决策质量,支持每秒数百Pod的调度并发
- 构建异构资源调度体系,实现GPU/CPU/内存/高速互联网给的多维资源建模与在离线混部,提升集群整体利用率
- 研发抢占、回填、gang-scheduling、coscheduling等高级调度能力,保障大模型训练任务与推理服务的SLO
- 设计调度仿真与A/B测试框架,通过真实负载回放验证调度策略效果,推动调度算法持续迭代
任职要求
- 计算机相关专业,3年以上后端/基础架构开发经验
- 精通Go语言,深度掌握Kubernetes生态
- 扎实的调度算法基础(资源调度、任务调度、负载均衡、装箱优化),有大规模分布式系统设计与性能优化经验
- 熟悉GPU集群架构(NVLink/InfiniBand/RoCE),理解AI训练/推理任务对资源调度的特殊诉求
- 责任心强,深度理解业务问题,能主动拓展能力边界
- 具备出色的系统级问题定位能力,能通过代码级分析解决调度死锁、资源竞争、热点节点等复杂问题
- 加分项:Kubernetes/Volcano/YARN/Mesos等调度系统社区贡献者
- 加分项:有GPU/NPU大规模集群调度实际落地经验
- 加分项:具备eBPF/内核调优及监控经验
加分项
- Kubernetes/Volcano/YARN/Mesos 等调度系统社区贡献者
- 有 GPU/NPU 大规模集群调度实际落地经验
- 具备 eBPF/内核调优及监控经验
- 毕女士 本周活跃
福利待遇
- 薪资范围35-60K·14薪
- 工作地点在北京海淀区京东科技大厦
- 团队氛围活跃,HR直接沟通
工作地址
北京海淀区京东科技大厦13
登录后查看完整岗位详情
使用邮箱验证码登录后,可查看完整职责、任职要求、原岗位入口,并继续使用收藏和浏览记录。列表摘要保持公开,完整详情用于保护数据质量和降低恶意抓取。