基础设施工程师
岗位摘要
运营全球最大的GPU超级计算集群,用于AI训练和生产模型服务;实施基础设施即代码最佳实践,增强部署流水线;确保生产环境中的服务交付具有鲁棒性和安全性;同时管理本地集群和云服务提供商;协助为内部研究人员和实时外部流量实施安全最佳实践
登录后保留你的岗位线索
邮箱登录后可继续查看完整职责、任职要求和原岗位入口,并使用收藏与浏览记录沉淀适合自己的机会。
岗位职责
- 运营全球最大的GPU超级计算集群,用于AI训练和生产模型服务
- 实施基础设施即代码最佳实践,增强部署流水线
- 确保生产环境中的服务交付具有鲁棒性和安全性
- 同时管理本地集群和云服务提供商
- 协助为内部研究人员和实时外部流量实施安全最佳实践
任职要求
- 使用Rust编写可扩展且高可用的容器化应用程序
- 使用Pulumi、Terraform、Ansible或其他有状态自动化库管理计算资源
- 技术栈包括Kubernetes、Pulumi、Rust和Go、Flux/ArgoCD
- 候选人需位于湾区附近或愿意搬迁
- 具备出色的沟通能力,能够简洁准确地与团队成员分享知识
- 工作积极主动,注重工程卓越,具备强大的工作伦理和优先级排序能力
福利待遇
- 全面的医疗、视力和牙科保险
- 401(k)退休计划
- 短期和长期残疾保险
- 各种其他折扣和福利
登录后查看完整岗位详情
使用邮箱验证码登录后,可查看完整职责、任职要求、原岗位入口,并继续使用收藏和浏览记录。列表摘要保持公开,完整详情用于保护数据质量和降低恶意抓取。