数据中心硬件运维技术员,AI计算基础设施 - Stargate
岗位摘要
作为OpenAI的主要现场硬件联系人,与Oracle团队和供应商合作,规划和协调维护、维修和生命周期活动;分享技术要求并验证所执行的工作是否符合OpenAI的计算需求和商定的质量目标
登录后保留你的岗位线索
邮箱登录后可继续查看完整职责、任职要求和原岗位入口,并使用收藏与浏览记录沉淀适合自己的机会。
岗位职责
- 作为OpenAI的主要现场硬件联系人,与Oracle团队和供应商合作,规划和协调维护、维修和生命周期活动
- 分享技术要求并验证所执行的工作是否符合OpenAI的计算需求和商定的质量目标
- 与合作伙伴团队协调时间表、备件计划和问题升级,以最小化停机时间并保持运营顺畅
- 与OpenAI的舰队健康工程师合作,将软件检测到的问题转化为现场硬件行动
- 跟踪硬件趋势,并与合作伙伴团队共同提出设计或运营改进建议
- 准备文档和运行手册,记录联合最佳实践,并可在其他园区应用
- 向合作伙伴人员提供技术指导和背景,同时尊重他们的运营所有权
- 与供应链团队合作,规划备件和管理硬件生命周期活动
任职要求
- 拥有7年以上数据中心硬件运营、硬件工程或大规模服务器维护经验,其中至少2年担任高级或首席技术员
- 深入了解高密度服务器硬件,包括x86平台、GPU、存储设备和电源/冷却系统
- 擅长诊断硬件问题、协调复杂维修和维护跨组织的良好工作关系
- 能够通过协作而非直接管理来设定技术期望并验证结果
- 能够快速适应变化的运营条件,并喜欢在战略和现场层面解决问题
- 能够清晰沟通并在合作伙伴团队、供应商和内部工程利益相关者之间建立信任
- 愿意全职驻扎在合作伙伴运营的园区
登录后查看完整岗位详情
使用邮箱验证码登录后,可查看完整职责、任职要求、原岗位入口,并继续使用收藏和浏览记录。列表摘要保持公开,完整详情用于保护数据质量和降低恶意抓取。