技术项目经理,计算基础设施
岗位摘要
领导新计算SKU和大规模GPU集群在外部合作伙伴生态系统中的端到端交付,同时支持训练和推理的容量规划;具备情境化驱动多线程启动项目的能力,涵盖硬件、网络、电源和冷却,负责计划、依赖关系和关键路径
登录后保留你的岗位线索
邮箱登录后可继续查看完整职责、任职要求和原岗位入口,并使用收藏与浏览记录沉淀适合自己的机会。
岗位职责
- 领导新计算SKU和大规模GPU集群在外部合作伙伴生态系统中的端到端交付,同时支持训练和推理的容量规划
- 具备情境化驱动多线程启动项目的能力,涵盖硬件、网络、电源和冷却,负责计划、依赖关系和关键路径
- 与芯片提供商对接,通过跨内核、通信、硬件和调度工程团队的合作,降低长期引入新硬件平台的风险
- 构建并运营项目机制(路线图、里程碑、风险登记册、运行手册),使交付在超大规模下可预测
- 与工程团队合作,提高集群上线的可靠性、可重复性和自动化程度,缩短新容量的交付时间
- 支持网络运营以及OpenAI网络接入点(PoP)的端到端物理和逻辑上线,包括现场部署、机架布线和与工程团队的紧密协作
- 协调跨职能准备工作(安全、财务、运营、产品/研究利益相关者),以交付生产就绪的计算资源
- 管理跨团队和合作伙伴的集成与交接,确保一致执行、清晰沟通和快速问题解决
- 识别瓶颈和系统性差距,推动工具、流程和合作伙伴接口的持久改进
- 为管理层提供关于并行项目组合进展、权衡和风险的清晰可见性
任职要求
- 拥有硬科学学位,或具备经过验证的工程专业知识记录
- 5年以上重大项目(包括资本项目或超大规模基础设施部署)的项目管理经验
- 能够作为唯一负责人推动和交付复杂项目
- 擅长管理跨职能和跨公司团队,具备推动信息和决策规范的经验
- 在紧迫期限内成功交付高知名度技术项目的丰富记录
- 技术能力强,曾与最高水平的工程或基础研究团队有效合作
- 有与外部供应商(包括工程公司、设备供应商和/或建筑公司)对接和领导的经验
- 具备设计和实施简单、可扩展流程以解决复杂问题的专业知识
- 有管理复杂依赖关系(如物流和/或供应链)的经验
- 具有极强的资源整合能力,能在模糊、快节奏的环境中茁壮成长
福利待遇
- 混合工作模式(每周3天在办公室)
- 参与前沿AI基础设施项目的机会
- 与顶尖工程和研究团队合作
登录后查看完整岗位详情
使用邮箱验证码登录后,可查看完整职责、任职要求、原岗位入口,并继续使用收藏和浏览记录。列表摘要保持公开,完整详情用于保护数据质量和降低恶意抓取。